evaluation_run
Run a test that compares code context retrieval against a golden set using a stored snapshot.
Instructions
evaluation run
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| request_id | No | ||
| thresholds | No | ||
| snapshot_id | Yes | ||
| operation_id | No | ||
| tool_version | No | ||
| golden_set_id | Yes | ||
| repository_id | Yes | ||
| config_version | No | ||
| schema_version | No | ||
| source_revision | Yes | ||
| golden_set_version | Yes |