llama.cpp
quantize: cap working memory size to avoid loading big tensors onto RAM
#27795
Merged

quantize: cap working memory size to avoid loading big tensors onto RAM #27795

ngxson merged 1 commit into master from xsn/quant_cap
ngxson
ngxson quantize: cap working memory size to avoid loading big tensors onto RAM
c0c7fa93
ngxson ngxson requested a review from ggerganov ggerganov 6 days ago
github-actions github-actions added examples
ngxson ngxson requested a review from ServeurpersoCom ServeurpersoCom 6 days ago
julianmb
ngxson
ServeurpersoCom
ServeurpersoCom
ServeurpersoCom approved these changes on 2026-08-27
ngxson ngxson merged 732707df into master 6 days ago

Login to write a write a comment.

Login via GitHub

Assignees
No one assigned
Labels
Milestone