# HELP vllm:spec_decode_num_drafts_total Number of spec decoding drafts. # TYPE vllm:spec_decode_num_drafts_total counter vllm:spec_decode_num_drafts_total{engine="0",model_name="qwen3.8-flash-next"} 8872.0 # HELP vllm:spec_decode_num_drafts_created Number of spec decoding drafts. # TYPE vllm:spec_decode_num_drafts_created gauge vllm:spec_decode_num_drafts_created{engine="0",model_name="qwen3.8-flash-next"} 1.789743834577659e+09 # HELP vllm:spec_decode_num_draft_tokens_total Number of draft tokens. # TYPE vllm:spec_decode_num_draft_tokens_total counter vllm:spec_decode_num_draft_tokens_total{engine="0",model_name="qwen3.8-flash-next"} 26616.0 # HELP vllm:spec_decode_num_draft_tokens_created Number of draft tokens. # TYPE vllm:spec_decode_num_draft_tokens_created gauge vllm:spec_decode_num_draft_tokens_created{engine="0",model_name="qwen3.8-flash-next"} 1.7897438345776758e+09 # HELP vllm:spec_decode_num_accepted_tokens_total Number of accepted tokens. # TYPE vllm:spec_decode_num_accepted_tokens_total counter vllm:spec_decode_num_accepted_tokens_total{engine="0",model_name="qwen3.8-flash-next"} 14825.0 # HELP vllm:spec_decode_num_accepted_tokens_created Number of accepted tokens. # TYPE vllm:spec_decode_num_accepted_tokens_created gauge vllm:spec_decode_num_accepted_tokens_created{engine="0",model_name="qwen3.8-flash-next"} 1.789743834577687e+09 # HELP vllm:spec_decode_num_accepted_tokens_per_pos_total Accepted tokens per draft position. # TYPE vllm:spec_decode_num_accepted_tokens_per_pos_total counter vllm:spec_decode_num_accepted_tokens_per_pos_total{engine="0",model_name="qwen3.8-flash-next",position="0"} 6682.0 vllm:spec_decode_num_accepted_tokens_per_pos_total{engine="0",model_name="qwen3.8-flash-next",position="1"} 4815.0 vllm:spec_decode_num_accepted_tokens_per_pos_total{engine="0",model_name="qwen3.8-flash-next",position="2"} 3328.0 # HELP vllm:spec_decode_num_accepted_tokens_per_pos_created Accepted tokens per draft position. # TYPE vllm:spec_decode_num_accepted_tokens_per_pos_created gauge vllm:spec_decode_num_accepted_tokens_per_pos_created{engine="0",model_name="qwen3.8-flash-next",position="0"} 1.789743834577702e+09 vllm:spec_decode_num_accepted_tokens_per_pos_created{engine="0",model_name="qwen3.8-flash-next",position="1"} 1.7897438345777066e+09 vllm:spec_decode_num_accepted_tokens_per_pos_created{engine="0",model_name="qwen3.8-flash-next",position="2"} 1.7897438345777097e+09