llama.cpp
CUDA: batched+noncont MMQ, refactor bs>1 MoE code
#13199
Merged

CUDA: batched+noncont MMQ, refactor bs>1 MoE code #13199

JohannesGaessler
JohannesGaessler CUDA: batched+noncont MMQ, refactor bs>1 MoE code
12bef0d3
github-actions github-actions added testing
github-actions github-actions added Nvidia GPU
github-actions github-actions added ggml
slaren
slaren
slaren approved these changes on 2025-04-30
JohannesGaessler JohannesGaessler merged e1e8e099 into master 1 year ago
danielhanchen
JohannesGaessler
danielhanchen
danielhanchen
JohannesGaessler
JohannesGaessler
ubergarm

Login to write a write a comment.

Login via GitHub

Reviewers
Assignees
No one assigned
Labels
Milestone