openai/gsm8k
Benchmark • Updated • 17.6k • 1.17M • 1.59k
How to use NamrataThakur/llama31-8bn_SFT with Transformers:
# Use a pipeline as a high-level helper
from transformers import pipeline
pipe = pipeline("question-answering", model="NamrataThakur/llama31-8bn_SFT") # Load model directly
from transformers import AutoTokenizer, AutoModelForCausalLM
tokenizer = AutoTokenizer.from_pretrained("NamrataThakur/llama31-8bn_SFT")
model = AutoModelForCausalLM.from_pretrained("NamrataThakur/llama31-8bn_SFT", device_map="auto")This llama model was trained 2x faster with Unsloth and Huggingface's TRL library.
| Base Model | Fine-Tuning | Train Dataset | Validation Loss | Evaluation Dataset | Mean Answer Relevancy Score | Mean Answer Correctness Score |
|---|---|---|---|---|---|---|
| Llama3.1-8bn | Supervised Fine-Tuning | GSM8K | 1.12 | SmallThoughts | 0.736 | 0.437 |