HIP: use hipBLAS for dense prefill on gfx900, keep MMQ for MoE #24588
HIP: keep MMQ for gfx900 MoE and Q8_0, use hipBLAS for dense K-quants
25c55df1
HIP: tighten conditional block to be explicitly for gfx900
717920bf
HIP: Further simplified gfx900 conditional block
76fd3124
sanmai
commented
on 2026-06-15
IMbackK
requested changes
on 2026-06-15
removed unnecessary comment
5c54430b
IMbackK
approved these changes
on 2026-06-25
Assignees
No one assigned
Labels
Nvidia GPU
ggml
CUDA
Login to write a write a comment.
Login via GitHub