vllm:prefix_cache_queries
Counter for prefix cache queries, in queried tokens.
MetricPrometheusvLLM v0.10.1
At vLLM v0.10.1
Presentcounter
Counts prefix-cache activity in tokens.
vLLM vllm/v1/metrics/loggers.py · v0.10.1
counter_gpu_prefix_cache_queries = self._counter_cls(
name="vllm:gpu_prefix_cache_queries",
documentation=(
"GPU prefix cache queries, in terms of number of queried"
"tokens. DEPRECATED: Use vllm:prefix_cache_queries instead."),
labelnames=labelnames)vLLM vllm/v1/metrics/loggers.py · v0.10.1
counter_prefix_cache_queries = self._counter_cls(
name="vllm:prefix_cache_queries",
documentation=(
"Prefix cache queries, in terms of number of queried tokens."),
labelnames=labelnames)vLLM vllm/v1/metrics/stats.py · v0.10.1
# means the number of tokens that were queried from the cache.
Lifecycle
| vLLM version | State | Metric name |
|---|---|---|
| v0.27.1 | present | vllm:prefix_cache_queries |
| v0.27.0 | present | vllm:prefix_cache_queries |
| v0.26.0 | present | vllm:prefix_cache_queries |
| v0.25.1 | present | vllm:prefix_cache_queries |
| v0.25.0 | present | vllm:prefix_cache_queries |
| v0.24.0 | present | vllm:prefix_cache_queries |
| v0.23.0 | present | vllm:prefix_cache_queries |
| v0.22.1 | present | vllm:prefix_cache_queries |
| v0.22.0 | present | vllm:prefix_cache_queries |
| v0.21.0 | present | vllm:prefix_cache_queries |
| v0.20.2 | present | vllm:prefix_cache_queries |
| v0.20.1 | present | vllm:prefix_cache_queries |
| v0.20.0 | present | vllm:prefix_cache_queries |
| v0.19.1 | present | vllm:prefix_cache_queries |
| v0.19.0 | present | vllm:prefix_cache_queries |
| v0.18.1 | present | vllm:prefix_cache_queries |
| v0.18.0 | present | vllm:prefix_cache_queries |
| v0.17.1 | present | vllm:prefix_cache_queries |
| v0.17.0 | present | vllm:prefix_cache_queries |
| v0.16.0 | present | vllm:prefix_cache_queries |
| v0.15.1 | present | vllm:prefix_cache_queries |
| v0.15.0 | present | vllm:prefix_cache_queries |
| v0.14.1 | present | vllm:prefix_cache_queries |
| v0.14.0 | present | vllm:prefix_cache_queries |
| v0.13.0 | present | vllm:prefix_cache_queries |
| v0.12.0 | present | vllm:prefix_cache_queries |
| v0.11.2 | present | vllm:prefix_cache_queries |
| v0.11.1 | present | vllm:prefix_cache_queries |
| v0.11.0 | present | vllm:prefix_cache_queries |
| v0.10.2 | present | vllm:prefix_cache_queries |
| v0.10.1.1 | present | vllm:prefix_cache_queries |
| v0.10.1 · selected | present | vllm:prefix_cache_queries |
| v0.10.0 | present | vllm:prefix_cache_queries |
| v0.9.2 | present | vllm:prefix_cache_queries |
| v0.9.1 | present | vllm:gpu_prefix_cache_queries |
| v0.9.0.1 | present | vllm:gpu_prefix_cache_queries |
| v0.9.0 | present | vllm:gpu_prefix_cache_queries |
| v0.8.5.post1 | present | vllm:gpu_prefix_cache_queries |
| v0.8.5 | present | vllm:gpu_prefix_cache_queries |
| v0.8.4 | present | vllm:gpu_prefix_cache_queries |
| v0.8.3 | present | vllm:gpu_prefix_cache_queries |
| v0.8.2 | present | vllm:gpu_prefix_cache_queries |
| v0.8.1 | present | vllm:gpu_prefix_cache_queries |
| v0.8.0 | present | vllm:gpu_prefix_cache_queries |
| v0.7.3 | present | vllm:gpu_prefix_cache_queries |
| v0.7.2 | absent | vllm:prefix_cache_queries |
| v0.7.1 | absent | vllm:prefix_cache_queries |
| v0.7.0 | absent | vllm:prefix_cache_queries |