rghosh8 commited on
Commit
3703fa5
·
verified ·
1 Parent(s): c780354

Upload README.md with huggingface_hub

Browse files
Files changed (1) hide show
  1. README.md +25 -0
README.md ADDED
@@ -0,0 +1,25 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ language:
3
+ - en
4
+ library_name: transformers
5
+ pipeline_tag: text-generation
6
+ tags:
7
+ - grpo
8
+ - gsm8k
9
+ - math
10
+ - lora
11
+ base_model: nvidia/Nemotron-Mini-4B-Instruct
12
+ ---
13
+
14
+ # gsm8k-Nemotron-Mini-4B-Instruct-rajat-seed-3407_merged
15
+
16
+ Merged model fine-tuned from [nvidia/Nemotron-Mini-4B-Instruct](https://huggingface.co/nvidia/Nemotron-Mini-4B-Instruct) on GSM8K using GRPO.
17
+
18
+ ## Usage
19
+
20
+ ```python
21
+ from transformers import AutoModelForCausalLM, AutoTokenizer
22
+
23
+ model = AutoModelForCausalLM.from_pretrained("rghosh8/gsm8k-Nemotron-Mini-4B-Instruct-rajat-seed-3407_merged", torch_dtype="auto", device_map="auto")
24
+ tokenizer = AutoTokenizer.from_pretrained("rghosh8/gsm8k-Nemotron-Mini-4B-Instruct-rajat-seed-3407_merged")
25
+ ```