llama.cpp
b22da258 - ggml-webgpu: add q4_0/q8_0 SET_ROWS (#23760)

Commit
62 days ago
ggml-webgpu: add q4_0/q8_0 SET_ROWS (#23760) * Add q8_0 and q4_0 set_rows * Add fast(er) quantization set_rows path * formatting/naming * a little more naming * Remove unused constant * Don't override other override * Avoid bitcast * Narrow relaxation
Author
Parents
Loading