Score an agent run provisionally
score_agent_runCreate an unverified self-assessment of an agent run's outcome, evidence, control, and correction cost. Use it to evaluate agent performance without granting autonomy.
Instructions
Create an unverified self-assessment of outcome, evidence, control and correction cost. Never use it alone to grant autonomy.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| task | Yes | ||
| actualOutcome | Yes | ||
| expectedOutcome | Yes | ||
| evidenceProvided | Yes | ||
| correctionsNeeded | Yes | ||
| unauthorizedActions | Yes | ||
| humanApprovalObtained | Yes | ||
| requiredHumanApproval | Yes |