toad_run_eval
Run evaluation suites to measure prompt variant performance, providing scores and pass/fail results to guide prompt optimization.
Instructions
Run an evaluation suite from the Eval Framework. Executes test cases against a prompt variant and returns scores and pass/fail results.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| suite | Yes | Name of the eval suite to run | |
| variant | No | Prompt variant to evaluate | default |