whisper.cpp
e57e95eb - CUDA: add FP32 FlashAttention vector kernel (llama/7188)

Commit
2 years ago
CUDA: add FP32 FlashAttention vector kernel (llama/7188) * CUDA: add FP32 FlashAttention vector kernel * fixup! CUDA: add FP32 FlashAttention vector kernel * fixup! fixup! CUDA: add FP32 FlashAttention vector kernel * fixup! fixup! fixup! CUDA: add FP32 FlashAttention vector kernel
Committer
Parents
Loading