Update README.md
Browse files
README.md
CHANGED
|
@@ -2,7 +2,7 @@
|
|
| 2 |
datasets:
|
| 3 |
- NeelNanda/pile-10k
|
| 4 |
base_model:
|
| 5 |
-
- deepseek-ai/DeepSeek-R1
|
| 6 |
|
| 7 |
|
| 8 |
|
|
@@ -160,42 +160,30 @@ pip3 install lm-eval==0.4.7
|
|
| 160 |
```bash
|
| 161 |
lm-eval --model hf --model_args pretrained=OPEA/DeepSeek-R1-Distill-Qwen-32B-int4-sym-inc --tasks leaderboard_mmlu_pro,leaderboard_ifeval,lambada_openai,hellaswag,piqa,winogrande,truthfulqa_mc1,openbookqa,boolq,arc_easy,arc_challenge,mmlu,gsm8k --batch_size 16
|
| 162 |
```
|
| 163 |
-
| Metric | BF16
|
| 164 |
| :------------------------: | :----------------------: | :---------------: |
|
| 165 |
-
|
|
| 166 |
-
|
|
| 167 |
-
|
|
| 168 |
-
|
|
| 169 |
-
|
|
| 170 |
-
|
|
| 171 |
-
|
|
| 172 |
-
|
|
| 173 |
-
|
|
| 174 |
-
|
|
| 175 |
-
|
|
| 176 |
-
|
|
| 177 |
-
|
|
| 178 |
-
|
|
|
|
|
|
|
|
| 179 |
|
| 180 |
|
| 181 |
### Generate the model
|
| 182 |
|
| 183 |
-
~~~
|
| 184 |
-
import torch
|
| 185 |
-
from transformers import AutoModelForCausalLM, AutoTokenizer
|
| 186 |
-
import transformers
|
| 187 |
|
| 188 |
-
model_name = "deepseek-ai/DeepSeek-R1-Distill-Qwen-32B"
|
| 189 |
-
tokenizer = AutoTokenizer.from_pretrained(model_name)
|
| 190 |
-
model = AutoModelForCausalLM.from_pretrained(model_name, trust_remote_code=True, torch_dtype="auto")
|
| 191 |
-
device_map = "auto"
|
| 192 |
-
|
| 193 |
-
from auto_round import AutoRound
|
| 194 |
-
autoround = AutoRound(model=model, tokenizer=tokenizer, device_map=device_map, nsamples=512,
|
| 195 |
-
batch_size=4, seqlen=2048,
|
| 196 |
-
)
|
| 197 |
-
autoround.quantize()
|
| 198 |
-
autoround.save_quantized(format="auto_gptq", output_dir="tmp_autoround")
|
| 199 |
|
| 200 |
~~~
|
| 201 |
|
|
|
|
| 2 |
datasets:
|
| 3 |
- NeelNanda/pile-10k
|
| 4 |
base_model:
|
| 5 |
+
- deepseek-ai/DeepSeek-R1-Distill-Qwen-32B
|
| 6 |
|
| 7 |
|
| 8 |
|
|
|
|
| 160 |
```bash
|
| 161 |
lm-eval --model hf --model_args pretrained=OPEA/DeepSeek-R1-Distill-Qwen-32B-int4-sym-inc --tasks leaderboard_mmlu_pro,leaderboard_ifeval,lambada_openai,hellaswag,piqa,winogrande,truthfulqa_mc1,openbookqa,boolq,arc_easy,arc_challenge,mmlu,gsm8k --batch_size 16
|
| 162 |
```
|
| 163 |
+
| Metric | BF16 | INT4 |
|
| 164 |
| :------------------------: | :----------------------: | :---------------: |
|
| 165 |
+
| avg | 0.6647 | 0.6639|
|
| 166 |
+
|----------------------|--------|--------|
|
| 167 |
+
| leaderboard_mmlu_pro | - | - |
|
| 168 |
+
| mmlu | 0.7964 | 0.7928 |
|
| 169 |
+
| lambada_openai | 0.6649 | 0.6718 |
|
| 170 |
+
| hellaswag | 0.6292 | 0.6223 |
|
| 171 |
+
| winogrande | 0.7482 | 0.7482 |
|
| 172 |
+
| piqa | 0.8058 | 0.7982 |
|
| 173 |
+
| truthfulqa_mc1 | 0.3831 | 0.3905 |
|
| 174 |
+
| openbookqa | 0.3520 | 0.3520 |
|
| 175 |
+
| boolq | 0.8963 | 0.8972 |
|
| 176 |
+
| arc_easy | 0.8207 | 0.8194 |
|
| 177 |
+
| arc_challenge | 0.5503 | 0.5469 |
|
| 178 |
+
| leaderboard_ifeval | - | - |
|
| 179 |
+
| gsm8k | - | - |
|
| 180 |
+
|
| 181 |
|
| 182 |
|
| 183 |
### Generate the model
|
| 184 |
|
| 185 |
+
~~~bash
|
|
|
|
|
|
|
|
|
|
| 186 |
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 187 |
|
| 188 |
~~~
|
| 189 |
|