llama.cpp
CUDA: enroll mul_mat_vec_q_moe into pdl
#24087
Merged

Commits
  • Enroll mul_mat_vec_q_moe into PDL, boosting MTP performance on BW
    ORippler committed 48 days ago
  • LC to overlap with following kernels
    ORippler committed 48 days ago
Loading