<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
  <url><loc>https://schema.ai/vllm</loc></url>
  <url><loc>https://schema.ai/vllm/claims</loc></url>
  <url><loc>https://schema.ai/vllm/sources</loc></url>
  <url><loc>https://schema.ai/vllm/metrics</loc></url>
  <url><loc>https://schema.ai/vllm/settings</loc></url>
  <url><loc>https://schema.ai/vllm/surfaces</loc></url>
  <url><loc>https://schema.ai/vllm/topics</loc></url>
  <url><loc>https://schema.ai/vllm/scenarios</loc></url>
  <url><loc>https://schema.ai/vllm/docs</loc></url>
  <url><loc>https://schema.ai/vllm/docs/graph-model</loc></url>
  <url><loc>https://schema.ai/vllm/surfaces/entity.vllm.config.scheduler_config</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.max_num_batched_tokens</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.max_num_seqs</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.max_model_len</loc></url>
  <url><loc>https://schema.ai/vllm/surfaces/entity.vllm.surface.prometheus_metrics</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.num_requests_running</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.num_requests_waiting</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.num_requests_waiting_by_reason</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.kv_cache_usage_perc</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.num_preemptions</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.engine_sleep_state</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.corrupted_requests</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.prefix_cache_queries</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.prefix_cache_hits</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.external_prefix_cache_queries</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.external_prefix_cache_hits</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.mm_cache_queries</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.mm_cache_hits</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.prompt_tokens</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.prompt_tokens_by_source</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.prompt_tokens_cached</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.generation_tokens</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.request_success</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.request_prompt_tokens</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.request_generation_tokens</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.iteration_tokens_total</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.request_max_num_generation_tokens</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.request_params_n</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.request_params_max_tokens</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.time_to_first_token_seconds</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.inter_token_latency_seconds</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.request_time_per_output_token_seconds</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.e2e_request_latency_seconds</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.request_queue_time_seconds</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.request_inference_time_seconds</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.request_prefill_time_seconds</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.request_decode_time_seconds</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.request_prefill_kv_computed_tokens</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.kv_block_lifetime_seconds</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.kv_block_idle_before_evict_seconds</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.kv_block_reuse_gap_seconds</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.lora_requests_info</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.cache_config_info</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.spec_decode_num_drafts</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.spec_decode_num_draft_tokens</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.spec_decode_num_accepted_tokens</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.spec_decode_num_accepted_tokens_per_pos</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.estimated_flops_per_gpu_total</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.estimated_read_bytes_per_gpu_total</loc></url>
  <url><loc>https://schema.ai/vllm/metrics/entity.vllm.metric.estimated_write_bytes_per_gpu_total</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.is_encoder_decoder</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.runner_type</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.max_num_scheduled_tokens</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.max_num_partial_prefills</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.max_long_partial_prefills</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.long_prefill_token_threshold</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.enable_chunked_prefill</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.is_multimodal_model</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.max_num_encoder_input_tokens</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.encoder_cache_size</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.policy</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.disable_chunked_mm_input</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.scheduler_cls</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.disable_hybrid_kv_cache_manager</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.scheduler_reserve_full_isl</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.async_scheduling</loc></url>
  <url><loc>https://schema.ai/vllm/settings/entity.vllm.parameter.stream_interval</loc></url>
  <url><loc>https://schema.ai/vllm/claims/claim.vllm.metric.request_decode_time_seconds.v0230.decode_interval_semantics</loc></url>
  <url><loc>https://schema.ai/vllm/claims/claim.vllm.metric.prefix_cache_queries.v0230.prometheus_counter</loc></url>
  <url><loc>https://schema.ai/vllm/claims/claim.vllm.metric.prefix_cache_hits.v0230.prometheus_counter</loc></url>
  <url><loc>https://schema.ai/vllm/claims/claim.vllm.metric.prefix_cache_queries.v0230.observes_prefix_cache_reuse</loc></url>
  <url><loc>https://schema.ai/vllm/claims/claim.vllm.metric.prefix_cache_hits.v0230.observes_prefix_cache_reuse</loc></url>
  <url><loc>https://schema.ai/vllm/claims/claim.vllm.metric.prefix_cache_hits.v0230.hit_rate_interpretation</loc></url>
  <url><loc>https://schema.ai/vllm/claims/claim.vllm.metric.num_requests_running.v0230.prometheus_gauge</loc></url>
  <url><loc>https://schema.ai/vllm/claims/claim.vllm.metric.num_requests_running.v0230.observes_scheduler_queue_state</loc></url>
  <url><loc>https://schema.ai/vllm/claims/claim.vllm.metric.num_requests_waiting.v0230.prometheus_gauge</loc></url>
  <url><loc>https://schema.ai/vllm/claims/claim.vllm.metric.num_requests_waiting_by_reason.v0230.reason_labels</loc></url>
  <url><loc>https://schema.ai/vllm/claims/claim.vllm.metric.kv_cache_usage_perc.v0230.prometheus_gauge</loc></url>
  <url><loc>https://schema.ai/vllm/claims/claim.vllm.metric.kv_cache_usage_perc.v0230.observes_kv_pressure</loc></url>
  <url><loc>https://schema.ai/vllm/claims/claim.vllm.metric.num_preemptions.v0230.prometheus_counter</loc></url>
  <url><loc>https://schema.ai/vllm/claims/claim.vllm.metric.num_preemptions.v0230.observes_preemption_pressure</loc></url>
  <url><loc>https://schema.ai/vllm/sources/source.vllm.code.config_scheduler.v0230</loc></url>
  <url><loc>https://schema.ai/vllm/sources/source.vllm.code.kv_connector_v1_metrics.v0230</loc></url>
  <url><loc>https://schema.ai/vllm/sources/source.vllm.code.v1_metrics_loggers.v0230</loc></url>
  <url><loc>https://schema.ai/vllm/sources/source.vllm.code.v1_metrics_perf.v0230</loc></url>
  <url><loc>https://schema.ai/vllm/sources/source.vllm.code.v1_metrics_stats.v0230</loc></url>
  <url><loc>https://schema.ai/vllm/sources/source.vllm.code.v1_spec_decode_metrics.v0230</loc></url>
  <url><loc>https://schema.ai/vllm/sources/source.vllm.docs.design_metrics.v0230</loc></url>
  <url><loc>https://schema.ai/vllm/topics/topic.vllm.scheduler-kv-pressure-metrics</loc></url>
  <url><loc>https://schema.ai/vllm/topics/topic.vllm.prefix-cache-effectiveness</loc></url>
  <url><loc>https://schema.ai/vllm/scenarios/scenario.vllm.exposition-total-name</loc></url>
  <url><loc>https://schema.ai/vllm/scenarios/scenario.vllm.prefix-cache-metric-of-interest</loc></url>
</urlset>
