llama.cpp
5fa07c2f
- CUDA: optimize FA for GQA + large batches (#12014)
Go
Login via GitHub
Home
Pricing
FAQ
Install
Login
via GitHub
Commit
View On
GitHub
Commit
1 year ago
CUDA: optimize FA for GQA + large batches (#12014)
References
#12014 - CUDA: optimize FA for GQA + large batches
Author
JohannesGaessler
Parents
335eb04a
Loading