Get LLM Model Stats
get_llm_model_statsGet detailed LLM model performance stats: request counts, latency percentiles, token usage, error rates, and finish reasons. Use to pinpoint issues and optimize.
Instructions
Get detailed performance statistics for a specific LLM model.
Analyzes request count, latency percentiles (p50, p95, p99), token usage statistics, error rates, and finish reason distributions.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| end_time | No | End time in ISO 8601 format | |
| model_name | Yes | Model name to analyze (e.g., "gpt-4", "claude-3-opus", "gpt-3.5-turbo") | |
| start_time | No | Start time in ISO 8601 format (e.g., 2024-01-01T00:00:00Z) | |
| service_name | No | Filter by service name |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| result | Yes |