{ "layer_combinations": [ [ 25, 50, 75 ] ], "act_layer_combinations": [ [ 10, 20, 30 ] ], "schema_version": 1, "special_token": " ?", "prefix_template": "Layer: {layer}\\n{special_token} * {num_positions} \\n", "model_name": "Qwen/Qwen3-14B", "hook_onto_layer": 1, "dataset_configs": [ { "custom_dataset_params": { "min_k_tokens": 1, "max_k_tokens": 50, "min_k_activations": 1, "max_k_activations": 1, "max_length": 2000, "directions": [ "past", "future" ], "vllm_max_new_tokens": 200, "max_vllm_context_tokens": 2000, "future_chat_system_prompt_prob": 0.5, "system_prompt_path": "datasets/latentqa_datasets/train/system.json", "english_only_temp_filter": false }, "num_train": 5000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "past_lens", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "min_k_tokens": 1, "max_k_tokens": 50, "min_k_activations": 1, "max_k_activations": 50, "max_length": 2000, "directions": [ "past", "future" ], "vllm_max_new_tokens": 200, "max_vllm_context_tokens": 2000, "future_chat_system_prompt_prob": 0.5, "system_prompt_path": "datasets/latentqa_datasets/train/system.json", "english_only_temp_filter": false }, "num_train": 5000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "past_lens", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "data_path": "datasets/latentqa_datasets/artifacts/Qwen3-8B/spqa_v2.json" }, "num_train": 5000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "synthetic_qa", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "classification_dataset_name": "geometry_of_truth", "num_qa_per_sample": 2, "min_end_offset": -1, "max_end_offset": -5, "max_window_size": 1, "min_window_size": 1 }, "num_train": 1000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "classification_geometry_of_truth", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "classification_dataset_name": "geometry_of_truth", "num_qa_per_sample": 1, "min_end_offset": -1, "max_end_offset": -5, "max_window_size": 50, "min_window_size": 1 }, "num_train": 1000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "classification_geometry_of_truth", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "classification_dataset_name": "relations", "num_qa_per_sample": 2, "min_end_offset": -1, "max_end_offset": -5, "max_window_size": 1, "min_window_size": 1 }, "num_train": 1000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "classification_relations", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "classification_dataset_name": "relations", "num_qa_per_sample": 1, "min_end_offset": -1, "max_end_offset": -5, "max_window_size": 50, "min_window_size": 1 }, "num_train": 1000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "classification_relations", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "classification_dataset_name": "sst2", "num_qa_per_sample": 2, "min_end_offset": -1, "max_end_offset": -5, "max_window_size": 1, "min_window_size": 1 }, "num_train": 1000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "classification_sst2", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "classification_dataset_name": "sst2", "num_qa_per_sample": 1, "min_end_offset": -1, "max_end_offset": -5, "max_window_size": 50, "min_window_size": 1 }, "num_train": 1000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "classification_sst2", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "classification_dataset_name": "md_gender", "num_qa_per_sample": 2, "min_end_offset": -1, "max_end_offset": -5, "max_window_size": 1, "min_window_size": 1 }, "num_train": 1000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "classification_md_gender", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "classification_dataset_name": "md_gender", "num_qa_per_sample": 1, "min_end_offset": -1, "max_end_offset": -5, "max_window_size": 50, "min_window_size": 1 }, "num_train": 1000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "classification_md_gender", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "classification_dataset_name": "snli", "num_qa_per_sample": 2, "min_end_offset": -1, "max_end_offset": -5, "max_window_size": 1, "min_window_size": 1 }, "num_train": 1000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "classification_snli", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "classification_dataset_name": "snli", "num_qa_per_sample": 1, "min_end_offset": -1, "max_end_offset": -5, "max_window_size": 50, "min_window_size": 1 }, "num_train": 1000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "classification_snli", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "classification_dataset_name": "ner", "num_qa_per_sample": 2, "min_end_offset": -1, "max_end_offset": -5, "max_window_size": 1, "min_window_size": 1 }, "num_train": 1000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "classification_ner", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "classification_dataset_name": "ner", "num_qa_per_sample": 1, "min_end_offset": -1, "max_end_offset": -5, "max_window_size": 50, "min_window_size": 1 }, "num_train": 1000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "classification_ner", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "classification_dataset_name": "tense", "num_qa_per_sample": 2, "min_end_offset": -1, "max_end_offset": -5, "max_window_size": 1, "min_window_size": 1 }, "num_train": 1000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "classification_tense", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "classification_dataset_name": "tense", "num_qa_per_sample": 1, "min_end_offset": -1, "max_end_offset": -5, "max_window_size": 50, "min_window_size": 1 }, "num_train": 1000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "classification_tense", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "data_path": "datasets/training_data/artifacts/synthetic_qa_2gpu_100k_qwen3_14b/training_data.json" }, "num_train": 10000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "synthetic_qa", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "data_path": "datasets/training_data/artifacts/system_prompt_qa/hidden_bias_v2_qwen3_14b/training_data.json" }, "num_train": 10000, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "synthetic_qa", "dataset_folder": "sft_training_data", "seed": 42 }, { "custom_dataset_params": { "data_path": "datasets/training_data/artifacts/system_prompt_qa/hidden_bias_inactive_qwen3_14b/training_data.json" }, "num_train": 49950, "num_test": 0, "splits": [ "train" ], "model_name": "Qwen/Qwen3-14B", "layer_combinations": [ [ 25, 50, 75 ] ], "save_acts": false, "batch_size": 16, "dataset_name": "synthetic_qa", "dataset_folder": "sft_training_data", "seed": 42 } ], "dataset_loader_names": [ "past_lens", "past_lens", "synthetic_qa", "classification_geometry_of_truth", "classification_geometry_of_truth", "classification_relations", "classification_relations", "classification_sst2", "classification_sst2", "classification_md_gender", "classification_md_gender", "classification_snli", "classification_snli", "classification_ner", "classification_ner", "classification_tense", "classification_tense", "synthetic_qa", "synthetic_qa", "synthetic_qa" ], "use_decoder_vectors": true, "generation_kwargs": { "do_sample": false, "max_new_tokens": 20 }, "steering_coefficient": 1.0, "dataset_folder": "sft_training_data", "chat_regularization_path": null, "chat_regularization_every_n_ao_updates": 0, "chat_regularization_weight": 1.0, "chat_regularization_max_train_examples": null, "train_batch_size": 16, "eval_batch_size": 128, "train_batches_per_materialization_block": 64, "use_lora": true, "lora_r": 64, "lora_alpha": 128, "lora_dropout": 0.05, "lora_target_modules": "all-linear", "num_epochs": 1, "lr": 5e-06, "gradient_accumulation_steps": 1, "max_grad_norm": 1.0, "eval_steps": 2000, "eval_on_start": false, "gradient_checkpointing": true, "window_mult": 20, "save_steps": 2000, "save_dir": "checkpoints/cont_50k_hbi_50k_mix_qwen3_14b", "max_train_examples": null, "seed": 42, "eval_logs_path": "eval_logs.json", "load_lora_path": "checkpoints/500k_pl_31k_spqav2_199k_sqav3_50k_hb_126k_cls_qwen3_14b/final", "created_at_utc": "", "git_commit": "", "wandb_project": "misc_experiments", "wandb_run_name": "cont_50k_hbi_50k_mix_qwen3_14b", "wandb_suffix": "_cont_50k_hbi_50k_mix_qwen3_14b", "hf_push_to_hub": false, "hf_private_repo": false, "hf_repo_name": "", "hf_repo_id": "", "load_in_8bit": false, "open_ended_eval_include": [ "number_prediction", "mmlu_prediction", "backtracking", "missing_info", "sycophancy", "system_prompt_qa_hidden", "system_prompt_qa_latentqa" ], "positive_negative_examples": false }