llama.cpp
c350a40b - Performance tune for gemma4-26b-a4b flash attention shape. (#28450)

Commit
5 days ago
Performance tune for gemma4-26b-a4b flash attention shape. (#28450)
Author
Parents
Loading