llama.cpp
2e1f0a88 - ggml: add Q1_0 1-bit quantization support (CPU) (#21273)

Commit

4 days ago

ggml: add Q1_0 1-bit quantization support (CPU) (#21273) * ggml: add Q1_0 and Q1_0_g128 1-bit quantization support (CPU) * add generic fallback for x86 * remove Q1_0 (group size 32) * rename Q1_0_g128 => Q1_0 * fix Q1_0 LlamaFileType Enum * Fix trailing spaces; add generic fallback for othre backends * Apply suggestions from code review Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@scala.com> * fix /r/n spacing + arch-fallback --------- Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@scala.com>

References

#21273 - ggml: add Q1_0 1-bit quantization support (CPU)

Author

khosravipasha

Parents

506200cf

llama.cpp 2e1f0a88 - ggml: add Q1_0 1-bit quantization support (CPU) (#21273)

llama.cpp
2e1f0a88 - ggml: add Q1_0 1-bit quantization support (CPU) (#21273)