onnxruntime
Adding cuda kernel (optimized for sm80) for block-wise 4b quantized float 16 GEMM.
#18619
Merged
Go
Login via GitHub
Home
Pricing
FAQ
Install
Login
via GitHub
Overview
Commits
13
Changes
View On
GitHub
Loading