athena_bandit_select
Selects the optimal action experiment using a contextual UCB bandit, balancing local regime evidence, cross-regime transfer, and uncertainty.
Instructions
Select an organization/action experiment using a diagonal contextual-UCB posterior with local-regime evidence, cross-regime transfer, uncertainty, and a V3 policy prior.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| arms | Yes | ||
| regime | No | ||
| context | Yes | ||
| signals | No | ||
| policy_scope | No | ||
| transfer_tau | No | ||
| exploration_alpha | No |