llama.cpp
d59d455f - tensor-split meta backend fixes (#26502)

Commit
8 days ago
tensor-split meta backend fixes (#26502) * backend: propagate buffer usage in meta backend * ggml-meta: make sure to call init_tensor for all new tensors * meta: remove explicit check for meta backend in ggml_backend_meta_get_split_state I can't seem to reproduce the original failure in the latest code.
Parents
Loading