request_metrics
Read vLLM latency metrics (TTFT, TPOT, e2e) and generation-token totals for GPU inference clusters. Omit target for default.
Instructions
[READ] vLLM TTFT / TPOT / e2e latency + generation-token totals.
Args: target: Inference target name from config; omit for the default.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| target | No |