llama.cpp
CUDA: fix padding of GQA to power of 2 in FA
#19115
Merged

CUDA: fix padding of GQA to power of 2 in FA #19115

JohannesGaessler
JohannesGaessler CUDA: fix padding of GQA to power of 2 in FA
060a6944
JohannesGaessler JohannesGaessler requested a review from ggerganov ggerganov 189 days ago
github-actions github-actions added testing
github-actions github-actions added Nvidia GPU
github-actions github-actions added ggml
ggerganov
ggerganov approved these changes on 2026-01-26
RodriMora
JohannesGaessler JohannesGaessler merged b0311c16 into master 188 days ago

Login to write a write a comment.

Login via GitHub

Reviewers
Assignees
No one assigned
Labels
Milestone