llama.cpp
CUDA: mul_mat_id for mmf for bs <= 64 for f16 and bs <= 32 for f32
#16277
Merged
Go
Login via GitHub
Home
Pricing
FAQ
Install
Login
via GitHub
Overview
Commits
2
Changes
View On
GitHub
Loading