vllm-response.json

{"id":"chatcmpl-b9602eeb2b8c8b7f","object":"chat.completion","created":1786434337,"model":"qwen3-4b-local","choices":[{"index":0,"message":{"role":"assistant","content":"Scheduler 在 LLM Serving 中负责任务调度与资源分配,决定哪些请求优先处理,平衡负载,提升响应效率与系统吞吐量,保障低延迟、高并发下的服务稳定性与公平性。","refusal":null,"annotations":null,"audio":null,"function_call":null,"reasoning":null},"logprobs":null,"finish_reason":"stop","stop_reason":null,"token_ids":null,"routed_experts":null}],"service_tier":null,"system_fingerprint":"vllm-0.27.0-45e1c693","usage":{"prompt_tokens":25,"total_tokens":70,"completion_tokens":45,"prompt_tokens_details":null},"prompt_logprobs":null,"prompt_token_ids":null,"prompt_text":null,"kv_transfer_params":null,"ec_transfer_params":null,"metrics":null}