llama.cpp
e495d1e7
- CUDA: fix Gemma E4B MTP FlashAttention (#25148)
Go
Login via GitHub
Home
Pricing
FAQ
Install
Login
via GitHub
Commit
View On
GitHub
Commit
27 days ago
CUDA: fix Gemma E4B MTP FlashAttention (#25148) * CUDA: fix Gemma E4B MTP FlashAttention * remove unused template declaration
References
#25148 - CUDA: fix Gemma E4B MTP FlashAttention
Author
JohannesGaessler
Parents
f708a5b2
Loading