Card: 64M final result (760k, eff 76.07), progress to 64M 760k / 128M 540k, tail-averaging rule, r6 trainer, pool_build, recipe link, board status 103ffaf verified Maggio33 commited on 9 days ago
Add pool_build/: removed document indices and a standalone script that rebuilds the final training pool (sha256 ecfd0a40) from ARC-MIX a918a0e verified Maggio33 commited on 9 days ago
Add train_gpt_ref_r6.py, the trainer of the final GoLLeM-v5 runs (sha256 0223c083) a520423 verified Maggio33 commited on 9 days ago
Card: 64M 640k-680k, 128M 420k/440k (progress rows only) ab9a418 verified Maggio33 commited on 9 days ago
Card: 64M 620k, 128M 400k, 400k comparison with v1 128M end of run 4c6c541 verified Maggio33 commited on 10 days ago
Card: 64M 560k-600k, 128M 380k (progress rows only) abd5b04 verified Maggio33 commited on 10 days ago
Card: 64M 500k-540k, 128M 340k/360k, v1 128M 360k reference 8e55eb1 verified Maggio33 commited on 10 days ago
Card: 64M 440k-480k, 128M 300k/320k, v1 128M 320k reference 54f12c1 verified Maggio33 commited on 10 days ago
Card: 64M 420k, 128M 280k, v1 128M 280k reference, resume check d518079 verified Maggio33 commited on 10 days ago
Card: 64M 380k/400k, 128M 260k, 400k comparison with v1 end of run fed0fb8 verified Maggio33 commited on 10 days ago