Srishti280992 commited on
Commit
e5f2a36
·
verified ·
1 Parent(s): 4d04310

Fix decoder-only padding and completion slicing

Browse files
Files changed (1) hide show
  1. evaluate_iapo_gsm8k.py +3 -1
evaluate_iapo_gsm8k.py CHANGED
@@ -102,6 +102,7 @@ def load_model(spec: dict[str, str | None], dtype: str):
102
  tokenizer = AutoTokenizer.from_pretrained(spec["repo"], **kwargs)
103
  if tokenizer.pad_token_id is None:
104
  tokenizer.pad_token = tokenizer.eos_token
 
105
  model = AutoModelForCausalLM.from_pretrained(
106
  spec["repo"],
107
  torch_dtype=torch_dtype,
@@ -186,8 +187,9 @@ def main() -> None:
186
  )
187
  gen_seconds += time.perf_counter() - t0
188
  prompt_lens = encoded["attention_mask"].sum(dim=1).tolist()
 
189
  expanded_prompt_lens = [
190
- prompt_lens[i]
191
  for i in range(len(prompt_lens))
192
  for _ in range(args.num_return_sequences)
193
  ]
 
102
  tokenizer = AutoTokenizer.from_pretrained(spec["repo"], **kwargs)
103
  if tokenizer.pad_token_id is None:
104
  tokenizer.pad_token = tokenizer.eos_token
105
+ tokenizer.padding_side = "left"
106
  model = AutoModelForCausalLM.from_pretrained(
107
  spec["repo"],
108
  torch_dtype=torch_dtype,
 
187
  )
188
  gen_seconds += time.perf_counter() - t0
189
  prompt_lens = encoded["attention_mask"].sum(dim=1).tolist()
190
+ input_width = int(encoded["input_ids"].shape[1])
191
  expanded_prompt_lens = [
192
+ input_width
193
  for i in range(len(prompt_lens))
194
  for _ in range(args.num_return_sequences)
195
  ]