llama.cpp
bbd488c4
- vulkan: add IQ3_S MMQ matmul kernels (#28822)
Go
Login via GitHub
Home
Pricing
FAQ
Install
Login
via GitHub
Commit
View On
GitHub
Commit
5 days ago
vulkan: add IQ3_S MMQ matmul kernels (#28822) * vulkan: add IQ3_S MMQ matmul kernels * Make block_a_to_shmem do 2-byte loads (110 bytes is divisible by 2) * Align the check, IQ3_S is also using K tile size
References
#28822 - vulkan: add IQ3_S MMQ matmul kernels
Author
vargad
Parents
dc85f89c
Loading