Let's help help help devs.
Target: <1000ms. Several important LLM CLI tools take multiple seconds. PRs welcome ❤️
First upstream <1s attempt: vLLM PR #41518.
2 measurement groups
tensorrt-llm --help
vllm --help
sglang --help
VLMEvalKit --help
tokenspeed --help
transformers --help
datasets --help
llm --help
openai --help
hf --help
lm-eval --help
langchain-cli --help
ollama --help
llama.cpp --help