Safetensors
qwen2
4-bit precision
gptq
cicdatopea commited on
Commit
e074213
·
verified ·
1 Parent(s): a8ea6d4

Update README.md

Browse files
Files changed (1) hide show
  1. README.md +19 -31
README.md CHANGED
@@ -2,7 +2,7 @@
2
  datasets:
3
  - NeelNanda/pile-10k
4
  base_model:
5
- - deepseek-ai/DeepSeek-R1
6
 
7
 
8
 
@@ -160,42 +160,30 @@ pip3 install lm-eval==0.4.7
160
  ```bash
161
  lm-eval --model hf --model_args pretrained=OPEA/DeepSeek-R1-Distill-Qwen-32B-int4-sym-inc --tasks leaderboard_mmlu_pro,leaderboard_ifeval,lambada_openai,hellaswag,piqa,winogrande,truthfulqa_mc1,openbookqa,boolq,arc_easy,arc_challenge,mmlu,gsm8k --batch_size 16
162
  ```
163
- | Metric | BF16(lm-eval==0.4.7) | INT4 |
164
  | :------------------------: | :----------------------: | :---------------: |
165
- | avg | | |
166
- | leaderboard_mmlu_pro 5shot | | |
167
- | mmlu | | |
168
- | lambada_openai | | |
169
- | hellaswag | | |
170
- | winogrande | | |
171
- | piqa | | |
172
- | truthfulqa_mc1 | | |
173
- | openbookqa | | |
174
- | boolq | | |
175
- | arc_easy | | |
176
- | leaderboard_ifeval | | |
177
- | arc_challenge | | |
178
- | gsm8k(5shot) strict match | | |
 
 
179
 
180
 
181
  ### Generate the model
182
 
183
- ~~~python
184
- import torch
185
- from transformers import AutoModelForCausalLM, AutoTokenizer
186
- import transformers
187
 
188
- model_name = "deepseek-ai/DeepSeek-R1-Distill-Qwen-32B"
189
- tokenizer = AutoTokenizer.from_pretrained(model_name)
190
- model = AutoModelForCausalLM.from_pretrained(model_name, trust_remote_code=True, torch_dtype="auto")
191
- device_map = "auto"
192
-
193
- from auto_round import AutoRound
194
- autoround = AutoRound(model=model, tokenizer=tokenizer, device_map=device_map, nsamples=512,
195
- batch_size=4, seqlen=2048,
196
- )
197
- autoround.quantize()
198
- autoround.save_quantized(format="auto_gptq", output_dir="tmp_autoround")
199
 
200
  ~~~
201
 
 
2
  datasets:
3
  - NeelNanda/pile-10k
4
  base_model:
5
+ - deepseek-ai/DeepSeek-R1-Distill-Qwen-32B
6
 
7
 
8
 
 
160
  ```bash
161
  lm-eval --model hf --model_args pretrained=OPEA/DeepSeek-R1-Distill-Qwen-32B-int4-sym-inc --tasks leaderboard_mmlu_pro,leaderboard_ifeval,lambada_openai,hellaswag,piqa,winogrande,truthfulqa_mc1,openbookqa,boolq,arc_easy,arc_challenge,mmlu,gsm8k --batch_size 16
162
  ```
163
+ | Metric | BF16 | INT4 |
164
  | :------------------------: | :----------------------: | :---------------: |
165
+ | avg | 0.6647 | 0.6639|
166
+ |----------------------|--------|--------|
167
+ | leaderboard_mmlu_pro | - | - |
168
+ | mmlu | 0.7964 | 0.7928 |
169
+ | lambada_openai | 0.6649 | 0.6718 |
170
+ | hellaswag | 0.6292 | 0.6223 |
171
+ | winogrande | 0.7482 | 0.7482 |
172
+ | piqa | 0.8058 | 0.7982 |
173
+ | truthfulqa_mc1 | 0.3831 | 0.3905 |
174
+ | openbookqa | 0.3520 | 0.3520 |
175
+ | boolq | 0.8963 | 0.8972 |
176
+ | arc_easy | 0.8207 | 0.8194 |
177
+ | arc_challenge | 0.5503 | 0.5469 |
178
+ | leaderboard_ifeval | - | - |
179
+ | gsm8k | - | - |
180
+
181
 
182
 
183
  ### Generate the model
184
 
185
+ ~~~bash
 
 
 
186
 
 
 
 
 
 
 
 
 
 
 
 
187
 
188
  ~~~
189