analyze_latency
Analyze latency distribution across traces with percentiles (P50-P99), average, and max. Optionally drill into per-generation latency to identify bottleneck models.
Instructions
Analyze latency distribution across traces and optionally per generation.
Returns: latency percentiles (P50/P90/P95/P99), average, max. group_by: 'domain', 'name', 'model'. Set include_per_generation=true to also analyze per-LLM-call latency (slower, fetches observations). Identifies which model is the bottleneck.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| tags | No | ||
| project | No | ||
| end_date | No | ||
| group_by | No | ||
| start_date | No | ||
| time_range | No | ||
| percentiles | No | 50,90,95,99 | |
| include_per_generation | No |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
No arguments | |||