llama.cpp
opencl: add flattened q6_K mv
#19054
Merged

opencl: add flattened q6_K mv #19054

lhez merged 11 commits into ggml-org:master from qualcomm:lh/q6_k-flat
lhez
lhez opencl: flatten `q6_K` and add `kernel_mul_mv_q6_K_f32_flat`
5ad71d4e
lhez opencl: clean up
4cd7a356
lhez opencl: refactor q6_K mv - put loop body in `block_q_6_K_dot_y_flat`
a1383d53
lhez opencl: tweak the workgroup size a bit
635d7452
lhez opencl: output 4 values per subgroup for `kernel_mul_mv_q6_K_f32_flat`
d8bb2f6e
lhez opencl: proper alignment for q6_K
28ff8afb
lhez opencl: boundary handling for flattened q6_K mv
10aa97e1
lhez opencl: rename q6_K mv kernel file
cd7667e9
lhez opencl: put flattened q6_K mv in its own file
46fd3fbc
lhez opencl: use lower k in file name
9a7ec6b3
lhez opencl: use K in variable names
6fa04dad
github-actions github-actions added ggml
github-actions github-actions added OpenCL
lhez lhez marked this pull request as ready for review 182 days ago
lhez lhez requested a review from max-krasnyansky max-krasnyansky 182 days ago
max-krasnyansky
max-krasnyansky approved these changes on 2026-01-25
lhez lhez merged 94eeb596 into master 179 days ago

Login to write a write a comment.

Login via GitHub

Reviewers
Assignees
No one assigned
Labels
Milestone