llama.cpp
opencl: use flat mv q5_k when weight exceeds image1d_buffer_t limit
#26880
Merged

opencl: use flat mv q5_k when weight exceeds image1d_buffer_t limit #26880

lhez
lhez opencl: use flat mv q5_k when weight exceeds image1d_buffer_t limit
5a169021
github-actions github-actions added ggml
github-actions github-actions added OpenCL
lhez lhez marked this pull request as ready for review 3 days ago
lhez lhez requested a review 3 days ago
max-krasnyansky
max-krasnyansky approved these changes on 2026-08-11
lhez lhez added merge ready
lhez
ggerganov ggerganov merged cb27fe9c into master 2 days ago

Login to write a write a comment.

Login via GitHub

Reviewers
Assignees
No one assigned
Labels
Milestone