rush_ai-eval
Evaluate LLM prompts, agent workflows, and safety guardrails. Specify a path and grant explicit permissions for live inference and resource access.
Instructions
Evaluate LLM prompts, agent workflows, and safety guardrails. Requires explicit permissions for live inference runs.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| path | Yes | ||
| allow_slow | No | ||
| allow_build | No | ||
| allow_browser | No | ||
| allow_network | No | ||
| allow_download | No | ||
| allow_cache_write | No | ||
| allow_artifact_write | No |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| raw | No | ||
| tool | No | ||
| engine | No | ||
| status | No | ||
| metrics | No | ||
| summary | No | ||
| findings | No | ||
| metadata | No | ||
| artifacts | No | ||
| duration_ms | No | ||
| review_kind | No | ||
| engine_version | No | ||
| review_provider | No |