llama.cpp
230ea9d2
- llama-batch: add n_keep_tail in split_equal for recurrent models (#25278)
Go
Login via GitHub
Home
Pricing
FAQ
Install
Login
via GitHub
Commit
View On
GitHub
Commit
42 days ago
llama-batch: add n_keep_tail in split_equal for recurrent models (#25278)
References
#25278 - llama-batch: enable parallel sequences for partial rollback
Author
am17an
Parents
f296fdfb
Loading