Add Serve Models guide for Jobs (vLLM + llama.cpp via exposed ports) #2554
Add Serve Models guide for Jobs (vLLM + llama.cpp via exposed ports)
063f5c47
Switch llama.cpp example to Gemma 4 E4B for a faster demo
b32a9e82
Add volume-mount tip for faster server startup
54d8156d
davanstrien
marked this pull request as ready for review 72 days ago
Wauplin
approved these changes
on 2026-06-16
davanstrien
deleted the jobs-serving-guide branch 62 days ago
Assignees
No one assigned
Login to write a write a comment.
Login via GitHub