serving-llms-vllm
Enables high-throughput LLM serving with OpenAI API compatibility, optimizing inference latency and GPU memory usage.
Install this skill
or
serving-llms-vllm5 files
Comments
Sign in to leave a comment.
No comments yet. Be the first to comment!
GitHub Stars 185.0K
Rate this skill
Categorydevelopment
UpdatedAugust 19, 2026
NousResearch/hermes-agent