Run evals
rubrkit_run_evalsStart an async eval run. Requires evals:run for API keys. Set mode: "advanced" with baselineVersionId and candidateVersionId to run a statistically-backed A/B (repeats defaults to 3, max 5).
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| mode | No | ||
| repeats | No | ||
| maxCases | No | ||
| testCases | No | ||
| auditRunId | No | ||
| sourceFileId | No | ||
| rubricVersion | No | ||
| candidateFileId | No | ||
| artifactBundleId | Yes | ||
| baselineVersionId | No | ||
| candidateVersionId | No | ||
| sourceFileVersionId | No | ||
| sourceVersionNumber | No | ||
| candidateFileVersionId | No | ||
| candidateVersionNumber | No |