llama.cpp
bbd488c4 - vulkan: add IQ3_S MMQ matmul kernels (#28822)

Commit
5 days ago
vulkan: add IQ3_S MMQ matmul kernels (#28822) * vulkan: add IQ3_S MMQ matmul kernels * Make block_a_to_shmem do 2-byte loads (110 bytes is divisible by 2) * Align the check, IQ3_S is also using K tile size
Author
Parents
Loading