{ "max_new_tokens": 100, "temperature": 0.8, "top_k": 50, "top_p": 0.95, "bos_token_id": 2, "eos_token_id": 3, "pad_token_id": 0, "model_type": "llama", "_learnllm_note": "decoding defaults used by learnllm inference" }