llama.cpp
CUDA: fix thread/block count in quantized cpy kernel launches
#26731
Merged

Commits
  • CUDA: fix thread/block count in quantized cpy kernel launches
    grafail committed 10 days ago
  • tests: add uneven block count cpy case
    grafail committed 10 days ago
Loading