martin_eval
Grade AI coding runs for task completion, verifier health, diff discipline, risk, and reviewability to identify failures and prevent bad code.
Instructions
Grade a Martin run for task completion, verifier health, diff discipline, risk, and reviewability.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| file | No | ||
| latest | No | ||
| loopId | No | ||
| runsDir | No |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
No arguments | |||