backend_health_rca
Diagnose backend outages by grouping unhealthy upstreams per service, pinpointing root causes like connection failures or DNS errors, and providing recommended actions for each.
Instructions
[READ] Down upstreams grouped per service, each mapped to cause + action.
The flagship availability RCA: pulls server-level upstream health, groups per service, and classifies each outage/degradation (connection refused, L4/L7 health-check failure class, DNS, admin maint/drain, all-servers-down) with a recommended action. Every finding carries its numbers. Pass 'upstreams' for pure analysis, or a target to pull live.
Args: service: Optional service/backend filter when pulling live. upstreams: Injected rows {service, server, address, status, checkInfo}; skips the live pull. target: Proxy target name from config; omit for the default.
Returns dict: {servicesEvaluated, outages, degraded, findings:[{service, serversTotal, up, down, maint, failingServers, cause, action}], note}.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| target | No | ||
| service | No | ||
| upstreams | No |