Schema.ai· vLLM
vLLM v0.23.0API up

vllm:num_requests_running

Gauge for the number of requests in model execution batches.

MetricPrometheusvLLM v0.23.0verified 4 hr ago

Claims (2)

Availability

vllm:num_requests_running is registered as a Prometheus gauge in vLLM v0.23.0.
vllm.surface.prometheus_metricscomplete_inventoryPrometheusStatLogger metrics publisher

vLLM v0.23.0 v1 metrics loggers.py · vllm/v1/metrics/loggers.py:451-459