#!/usr/bin/env bash #SBATCH --job-name=live-re10k-w12-full #SBATCH --nodes=1 #SBATCH --ntasks-per-node=8 #SBATCH --cpus-per-task=14 #SBATCH --gres=gpu:8 #SBATCH --time=48:00:00 #SBATCH --account=berzelius-2026-196 #SBATCH --chdir=/proj/cvl/users/x_fahkh2/worldmem-baseline-evals/LIVE #SBATCH --output=slurm_logs/%x-%A_%a.out #SBATCH --error=slurm_logs/%x-%A_%a.out set -euo pipefail module load buildenv-gcccuda/12.9.1-gcc11 ROOT=/proj/cvl/users/x_fahkh2/worldmem-baseline-evals ENV_ROOT=/proj/cvl/users/x_fahkh2/envs REPO=$ROOT/LIVE PYTHON=$ENV_ROOT/live-eval/bin/python METRIC_PYTHON=$ENV_ROOT/geometry-forcing-eval/bin/python WORLD_MEM_ROOT=$ROOT/references/worldmem DATA_ROOT=/proj/cvl/users/x_fahkh2/WorldMem_Repro/datasets/re10k_dfot/real-estate-10k MANIFEST=$ROOT/deployment/manifests/re10k_real_trajectory_h100_f399_scopes_v1.csv SEED=0 JOB=$SLURM_JOB_ID RUN=live_re10k_w12_100cases_seed${SEED}_job${JOB} OUTPUT=$REPO/outputs/$RUN PREFLIGHT_OUTPUT=$REPO/outputs/${RUN}_preflight export TMPDIR=$ROOT/cache export HF_HOME=$ROOT/cache/huggingface export TORCH_HOME=$ROOT/cache/torch export XDG_CACHE_HOME=$ROOT/cache export MPLCONFIGDIR=$ROOT/cache/matplotlib export TRITON_CACHE_DIR=$ROOT/cache export PYTHONNOUSERSITE=1 export PYTHONUNBUFFERED=1 export OMP_NUM_THREADS=4 export MKL_NUM_THREADS=4 export WANDB_MODE=disabled export HF_HUB_OFFLINE=1 export TRANSFORMERS_OFFLINE=1 mkdir -p "$TMPDIR" "$OUTPUT" cd "$REPO" "$PYTHON" "$ROOT/deployment/verify_node.py" --output "$OUTPUT" cp "$0" "$OUTPUT/launcher.sh" # Exercise the reduced window through the turnaround before the full evaluation. srun --exclusive --exact --nodes=1 --ntasks=1 --gpus-per-task=1 --cpus-per-task=14 --cpu-bind=cores \ "$PYTHON" "$ROOT/shared/run_and_score.py" \ --method live \ --workspace-root "$ROOT" \ --metric-python "$METRIC_PYTHON" \ --worldmem-root "$WORLD_MEM_ROOT" \ --manifest "$MANIFEST" \ --data-root "$DATA_ROOT" \ --output "$PREFLIGHT_OUTPUT" \ --scope final100 \ --seed "$SEED" \ --limit 1 \ --max-generated 104 \ --rank 0 \ --world-size 1 srun --exclusive --exact --nodes=1 --ntasks=1 --gpus-per-task=1 --cpus-per-task=14 \ "$METRIC_PYTHON" "$ROOT/shared/aggregate.py" \ --output "$PREFLIGHT_OUTPUT" \ --manifest "$MANIFEST" \ --dataset re10k \ --scope final100 \ --seed "$SEED" \ --expected-frames 104 \ --limit 1 srun --ntasks=8 --gpus-per-task=1 --cpus-per-task=14 --cpu-bind=cores --kill-on-bad-exit=1 \ "$PYTHON" "$ROOT/shared/run_and_score.py" \ --method live \ --workspace-root "$ROOT" \ --metric-python "$METRIC_PYTHON" \ --worldmem-root "$WORLD_MEM_ROOT" \ --manifest "$MANIFEST" \ --data-root "$DATA_ROOT" \ --output "$OUTPUT" \ --scope final100 \ --seed "$SEED" \ --limit 100 \ --max-generated 300 \ --world-size 8 srun --exclusive --exact --nodes=1 --ntasks=1 --gpus-per-task=1 --cpus-per-task=14 \ "$METRIC_PYTHON" "$ROOT/shared/aggregate.py" \ --output "$OUTPUT" \ --manifest "$MANIFEST" \ --dataset re10k \ --scope final100 \ --seed "$SEED"