vllm:prefix_cache_hits{model_name="qwen"} 260.0
vllm:prefix_cache_queries{model_name="qwen"} 700.0
vllm:external_prefix_cache_hits{model_name="qwen"} 70.0
vllm:external_prefix_cache_queries{model_name="qwen"} 100.0
vllm:generation_tokens{model_name="qwen"} 1800.0
vllm:kv_cache_usage_perc{model_name="qwen"} 0.42
vllm:kv_offload_load_bytes{model_name="qwen"} 9000.0
vllm:kv_offload_store_bytes{model_name="qwen"} 13000.0
vllm:time_to_first_token_seconds_bucket{le="0.01",model_name="qwen"} 5
vllm:time_to_first_token_seconds_bucket{le="0.05",model_name="qwen"} 15
vllm:time_to_first_token_seconds_bucket{le="0.1",model_name="qwen"} 26
vllm:time_to_first_token_seconds_bucket{le="+Inf",model_name="qwen"} 30
vllm:time_to_first_token_seconds_sum{model_name="qwen"} 1.55
vllm:time_to_first_token_seconds_count{model_name="qwen"} 30
