llama.cpp
CUDA: fix thread/block count in quantized cpy kernel launches
#26731
Merged

CUDA: fix thread/block count in quantized cpy kernel launches #26731

grafail
grafail CUDA: fix thread/block count in quantized cpy kernel launches
6862f133
grafail grafail requested a review 10 days ago
github-actions github-actions added ggml
github-actions github-actions added CUDA
am17an
am17an am17an assigned am17an am17an 10 days ago
grafail grafail requested a review from ggerganov ggerganov 10 days ago
github-actions github-actions added testing
am17an
grafail tests: add uneven block count cpy case
bf25a480
grafail grafail force pushed from c0ef90ef to bf25a480 10 days ago
grafail
am17an
am17an approved these changes on 2026-08-07
am17an
grafail
ggerganov
am17an am17an added merge ready
ggerganov ggerganov merged 69bf6437 into master 9 days ago

Login to write a write a comment.

Login via GitHub

Reviewers
Assignees
Labels
Milestone