Beexly commited on
Commit
ce322da
·
verified ·
1 Parent(s): c226c3a

gse brain engine: MiMo-V2.6 4-bit on ZeroGPU (free tier)

Browse files
Files changed (1) hide show
  1. app.py +1 -1
app.py CHANGED
@@ -59,7 +59,7 @@ def chat(message: str, history: list):
59
  with torch.inference_mode():
60
  out = model.generate(
61
  **inputs,
62
- max_new_tokens=1024,
63
  temperature=0.2,
64
  do_sample=True,
65
  pad_token_id=tokenizer.eos_token_id,
 
59
  with torch.inference_mode():
60
  out = model.generate(
61
  **inputs,
62
+ max_new_tokens=2048,
63
  temperature=0.2,
64
  do_sample=True,
65
  pad_token_id=tokenizer.eos_token_id,