llama.cpp
0324696b - fit : count nextn (MTP) blocks in n_gpu_layers so front layers stay on GPU (#26177)

Commit
10 days ago
fit : count nextn (MTP) blocks in n_gpu_layers so front layers stay on GPU (#26177)
Author
Parents
Loading