llama.cpp
8b0e0db6
- TP: fix granularity for Qwen 3.5/3.6 + 3 GPUs (#23843)
Go
Login via GitHub
Home
Pricing
FAQ
Install
Login
via GitHub
Commit
View On
GitHub
Commit
114 days ago
TP: fix granularity for Qwen 3.5/3.6 + 3 GPUs (#23843) * TP: fix granularity for Qwen 3.5/3.6 + 3 GPUs * fix afmoe TP
References
#23843 - TP: fix granularity for Qwen 3.5/3.6 + 3 GPUs
Author
JohannesGaessler
Parents
2d9b7c8e
Loading