Model context is limited to ~120k when running on iGPU
#5 opened 5 days ago
by
kaomoneus
Why no MTP for the int8 version
2
#4 opened 12 days ago
by
Old-M8
Any bios tweaks to improve inference performance?
#3 opened 15 days ago
by
kaomoneus
Unable to start
5
#2 opened 16 days ago
by
kaomoneus