ggml : optimize cuda cumsum fallback (~2.5x speedup vs CUB) #18343
am17an
commented
on 2025-12-24
am17an
approved these changes
on 2025-12-24
ggml : optimize cuda cumsum fallback kernel
4bc188b9
am17an
merged
c54bba86
into master 268 days ago
Assignees
No one assigned
Login to write a write a comment.
Login via GitHub