llama.cpp
opencl: perf optimization for mamba2 ssm_scan by folding 4 dim rows into one workgroup and add more coverage
#27775
Open

opencl: perf optimization for mamba2 ssm_scan by folding 4 dim rows into one workgroup and add more coverage #27775

wanghqc
wanghqc opencl: fold 4 dim rows into one mamba2 ssm_scan workgroup
f485dd91
wanghqc opencl: emit rollback snapshots from ssm_scan instead of falling back…
c904a135
github-actions github-actions added ggml
github-actions github-actions added OpenCL

Login to write a write a comment.

Login via GitHub

Reviewers
No reviews
Assignees
No one assigned
Labels
Milestone