Model context is limited to ~120k when running on iGPU
#5 opened 1 day ago
by
kaomoneus
Why no MTP for the int8 version
1
#4 opened 8 days ago
by
Old-M8
Any bios tweaks to improve inference performance?
#3 opened 11 days ago
by
kaomoneus
Unable to start
5
#2 opened 12 days ago
by
kaomoneus