llama.cpp
CUDA: use registers instead of smem in topk-moe
#16647
Merged

CUDA: use registers instead of smem in topk-moe #16647

am17an
am17an CUDA: use registers instead of smem in topk-moe
06cd6bd4
github-actions github-actions added Nvidia GPU
github-actions github-actions added ggml
am17an
JohannesGaessler
JohannesGaessler
JohannesGaessler approved these changes on 2025-10-18
am17an
JohannesGaessler JohannesGaessler merged 38355c6c into master 276 days ago
ggerganov
am17an
am17an am17an deleted the cuda_topk_optimize branch 276 days ago
am17an

Login to write a write a comment.

Login via GitHub

Reviewers
Assignees
No one assigned
Labels
Milestone