Fix decoder-only padding and completion slicing
Browse files- evaluate_iapo_gsm8k.py +3 -1
evaluate_iapo_gsm8k.py
CHANGED
|
@@ -102,6 +102,7 @@ def load_model(spec: dict[str, str | None], dtype: str):
|
|
| 102 |
tokenizer = AutoTokenizer.from_pretrained(spec["repo"], **kwargs)
|
| 103 |
if tokenizer.pad_token_id is None:
|
| 104 |
tokenizer.pad_token = tokenizer.eos_token
|
|
|
|
| 105 |
model = AutoModelForCausalLM.from_pretrained(
|
| 106 |
spec["repo"],
|
| 107 |
torch_dtype=torch_dtype,
|
|
@@ -186,8 +187,9 @@ def main() -> None:
|
|
| 186 |
)
|
| 187 |
gen_seconds += time.perf_counter() - t0
|
| 188 |
prompt_lens = encoded["attention_mask"].sum(dim=1).tolist()
|
|
|
|
| 189 |
expanded_prompt_lens = [
|
| 190 |
-
|
| 191 |
for i in range(len(prompt_lens))
|
| 192 |
for _ in range(args.num_return_sequences)
|
| 193 |
]
|
|
|
|
| 102 |
tokenizer = AutoTokenizer.from_pretrained(spec["repo"], **kwargs)
|
| 103 |
if tokenizer.pad_token_id is None:
|
| 104 |
tokenizer.pad_token = tokenizer.eos_token
|
| 105 |
+
tokenizer.padding_side = "left"
|
| 106 |
model = AutoModelForCausalLM.from_pretrained(
|
| 107 |
spec["repo"],
|
| 108 |
torch_dtype=torch_dtype,
|
|
|
|
| 187 |
)
|
| 188 |
gen_seconds += time.perf_counter() - t0
|
| 189 |
prompt_lens = encoded["attention_mask"].sum(dim=1).tolist()
|
| 190 |
+
input_width = int(encoded["input_ids"].shape[1])
|
| 191 |
expanded_prompt_lens = [
|
| 192 |
+
input_width
|
| 193 |
for i in range(len(prompt_lens))
|
| 194 |
for _ in range(args.num_return_sequences)
|
| 195 |
]
|