Aller au contenu
Source

vLLM — commande vllm bench serve

Options --backend openai-chat, --dataset-name, --num-prompts, --max-concurrency, --request-rate, --percentile-metrics ttft,tpot,itl,e2el, --metric-per.

Confirmée#benchmark#multi-utilisateursPublié le 16 sept. 2026Mis à jour le 16 sept. 2026
Organisation
vLLM
Type
Documentation officielle
Fiabilité
Fiabilité haute
Publié
2026
Consulté le
16 septembre 2026
Sujets
benchmark, multi-utilisateurs

Citée par 3 page(s)

Ce que dit la source

Options --backend openai-chat, --dataset-name, --num-prompts, --max-concurrency, --request-rate, --percentile-metrics ttft,tpot,itl,e2el, --metric-percentiles, --save-result.

Ce qu'on en retient

Fonctionne contre tout endpoint OpenAI, donc contre llama-server : outil de charge de référence du laboratoire.

Limites

Jeux de données anglophones par défaut ; prévoir nos prompts FR.

content/sources/vllm-bench-serve.md48 mots