rush_ai_eval
Evaluate LLM prompts, agent workflows, and safety guardrails to identify issues before deployment. Requires explicit permissions for live inference runs.
Instructions
Evaluate LLM prompts, agent workflows, and safety guardrails. Requires explicit permissions for live inference runs.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| path | Yes | ||
| allow_slow | No | ||
| allow_build | No | ||
| allow_browser | No | ||
| allow_network | No | ||
| allow_download | No | ||
| allow_cache_write | No | ||
| allow_artifact_write | No |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| raw | No | ||
| tool | No | ||
| engine | No | ||
| status | No | ||
| metrics | No | ||
| summary | No | ||
| findings | No | ||
| metadata | No | ||
| artifacts | No | ||
| duration_ms | No | ||
| review_kind | No | ||
| engine_version | No | ||
| review_provider | No |