llama.cpp
CUDA: enroll mul_mat_vec_q_moe into pdl
#24087
Merged
Go
Login via GitHub
Home
Pricing
FAQ
Install
Login
via GitHub
Overview
Commits
2
Changes
View On
GitHub
Commits
Enroll mul_mat_vec_q_moe into PDL, boosting MTP performance on BW
ORippler
committed
48 days ago
LC to overlap with following kernels
ORippler
committed
48 days ago
Loading