whisper.cpp
04445664
- CUDA: fix FlashAttention on Turing (llama/13415)
Go
Login via GitHub
Home
Pricing
FAQ
Install
Login
via GitHub
Commit
View On
GitHub
Commit
1 year ago
CUDA: fix FlashAttention on Turing (llama/13415)
References
#3148 - sync : ggml
Author
JohannesGaessler
Committer
ggerganov
Parents
22f4997d
Loading