generate.py: nrng decoding defaults (temp 0.7, rep-pen 1.15) -- best per decode_lab_chat
Browse files- generate.py +2 -2
generate.py
CHANGED
|
@@ -297,10 +297,10 @@ def main():
|
|
| 297 |
p.add_argument("--tok_dir", default=PKG_DIR, help="dir holding tokenizer.json")
|
| 298 |
p.add_argument("--prompt", default="the quazimoto oscillator")
|
| 299 |
p.add_argument("--max_new_tokens", type=int, default=200)
|
| 300 |
-
p.add_argument("--temperature", type=float, default=0.
|
| 301 |
p.add_argument("--top_k", type=int, default=40, help="0 to disable")
|
| 302 |
p.add_argument("--top_p", type=float, default=0.95, help="1.0 to disable")
|
| 303 |
-
p.add_argument("--repetition_penalty", type=float, default=1.
|
| 304 |
p.add_argument("--no_repeat_ngram", type=int, default=3, help="0 to disable")
|
| 305 |
p.add_argument("--seed", type=int, default=None)
|
| 306 |
p.add_argument("--chat", action="store_true", help="wrap prompt in ChatML framing")
|
|
|
|
| 297 |
p.add_argument("--tok_dir", default=PKG_DIR, help="dir holding tokenizer.json")
|
| 298 |
p.add_argument("--prompt", default="the quazimoto oscillator")
|
| 299 |
p.add_argument("--max_new_tokens", type=int, default=200)
|
| 300 |
+
p.add_argument("--temperature", type=float, default=0.7)
|
| 301 |
p.add_argument("--top_k", type=int, default=40, help="0 to disable")
|
| 302 |
p.add_argument("--top_p", type=float, default=0.95, help="1.0 to disable")
|
| 303 |
+
p.add_argument("--repetition_penalty", type=float, default=1.15, help="1.0 to disable")
|
| 304 |
p.add_argument("--no_repeat_ngram", type=int, default=3, help="0 to disable")
|
| 305 |
p.add_argument("--seed", type=int, default=None)
|
| 306 |
p.add_argument("--chat", action="store_true", help="wrap prompt in ChatML framing")
|