llama.cpp
Clean up per-thread parameter buffer pool and job submission logic
#19772
Merged

Clean up per-thread parameter buffer pool and job submission logic #19772

nikhilJain17
nikhilJain17 Merge
df604979
nikhilJain17 Merge
5ae7583c
nikhilJain17 merge
70238e02
nikhilJain17 Allow webgpu_buf_pool to resize if needed, remove inflight_threads, a…
2806b7d0
github-actions github-actions added ggml
nikhilJain17 Run clang-format
f4279953
nikhilJain17 Keep track of num batched kernels that have not been submitted yet
7cecc8a2
nikhilJain17 Run clang-format
58d2a91e
nikhilJain17 Increase buf pool max size
059e21b1
nikhilJain17 Increase param buf pool init size
4fa05f7a
nikhilJain17 Remove webgpu buf pool resizing
4b2af8ea
nikhilJain17 Merge with master
9f9d0640
nikhilJain17 Merge with master
a3e6d6fa
nikhilJain17 Merge with master
a87f3db9
nikhilJain17 Add buffer pool growth
a8694c07
nikhilJain17 Move buffer pool growth outside of lock
596e258b
nikhilJain17 Reduce max pool size to 32
a487db99
nikhilJain17 Run clang-format
8512456d
nikhilJain17 Only resize param buf pool
60ae42e3
nikhilJain17 nikhilJain17 marked this pull request as ready for review 218 days ago
nikhilJain17 nikhilJain17 requested a review from reeselevine reeselevine 218 days ago
reeselevine
reeselevine commented on 2026-03-02
reeselevine
reeselevine approved these changes on 2026-03-02
reeselevine reeselevine merged 4d828bd1 into master 217 days ago

Login to write a write a comment.

Login via GitHub

Reviewers
Assignees
No one assigned
Labels
Milestone