llama.cpp
5d16e81d
- convert : keep quantization scales for nemotron --mtp export (#26903)
Go
Login via GitHub
Home
Pricing
FAQ
Install
Login
via GitHub
Commit
View On
GitHub
Commit
7 days ago
convert : keep quantization scales for nemotron --mtp export (#26903) Signed-off-by: ynankani <ynankani@nvidia.com>
References
#26903 - Keep lm-head quantization scales for nemotron --mtp export
Author
ynankani
Parents
cc078b45
Loading