get_llm_model_stats
Retrieve performance statistics for a specific LLM model to analyze request counts, latency percentiles, token usage, error rates, and finish reasons.
Instructions
Get detailed performance statistics for a specific LLM model.
Analyzes request count, latency percentiles (p50, p95, p99), token usage statistics, error rates, and finish reason distributions.
Args: model_name: Model name to analyze (e.g., "gpt-4", "claude-3-opus", "gpt-3.5-turbo") start_time: Start time in ISO 8601 format (e.g., 2024-01-01T00:00:00Z) end_time: End time in ISO 8601 format service_name: Filter by service name
Returns: JSON string with comprehensive model statistics including duration/token percentiles
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| end_time | No | ||
| model_name | Yes | ||
| start_time | No | ||
| service_name | No |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| result | Yes |