tianzl66's picture
Release audited B300 LoRA training seed 43; actual zero warmup and complete in-domain HNS results
8617559 verified
Raw History Blame Contribute Delete
1.36 kB
{
"base_model": "<LOCAL_PATH>/Llama-3.1-8B-Instruct",
"task": "if",
"peft_method": "lora",
"output_dir": "<LOCAL_PATH>/tulu",
"dataset_path": "<LOCAL_PATH>/tulu-3-sft-personas-instruction-following-train.parquet",
"train_profile": "none",
"force_max_steps": false,
"max_steps": null,
"num_train_epochs": 2.0,
"stop_at_step": null,
"stop_at_epoch": null,
"resume_from_checkpoint": null,
"per_device_train_batch_size": 64,
"gradient_accumulation_steps": 2,
"global_train_batch_size": 128,
"lr": 0.0002,
"warmup_ratio": 0.1,
"weight_decay": 0.0,
"min_lr_ratio": 0.01,
"lr_scheduler_type": "cosine_with_min_lr",
"adam_beta1": 0.9,
"adam_beta2": 0.95,
"grad_clip": 1.0,
"max_seq_len": 1024,
"seed": 43,
"save_strategy": "epoch",
"save_steps": 500,
"save_total_limit": 1,
"logging_steps": null,
"max_train_samples": null,
"dataset_seed": 42,
"bf16": true,
"fp16": false,
"gradient_checkpointing": true,
"group_by_length": false,
"pad_to_multiple_of": 8,
"dataloader_num_workers": 0,
"optim": null,
"use_qlora": false,
"sft_format": "chat",
"chat_template_mode": "auto",
"target_modules": "all",
"r": 16,
"lora_alpha": 32,
"lora_dropout": 0.05,
"pissa_init_mode": "pissa",
"init_r": 32,
"target_r": 16,
"loraplus_lr_ratio": 20.0,
"loraplus_lr_embedding": null
}