llama.cpp
6dbc1174
- ggml-cpu: add AVX2 optimization for nvfp4 dot product and use UE4M3 LUT (#23961)
Go
Login via GitHub
Home
Pricing
FAQ
Install
Login
via GitHub
Commit
View On
GitHub
Commit
73 days ago
ggml-cpu: add AVX2 optimization for nvfp4 dot product and use UE4M3 LUT (#23961)
References
#23961 - ggml-cpu : add AVX2 and AVX optimization for nvfp4 dot product
Author
ragz4125
Parents
9d88e7ce
Loading