aetre_simulate_benchmark
Run Monte Carlo simulations across four screening regimes to compare quality throughput, FDR, unconventional recall, and review load with 95% outcome intervals.
Instructions
Runs a paired-cohort Monte Carlo simulation across all 4 screening regimes, comparing Quality Throughput, FDR, Unconventional Recall, and Human Reviews with central 95% run-to-run outcome intervals (not confidence intervals for the mean).
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| api_key | No | Enterprise license key required. | |
| replications | No | Number of Monte Carlo simulation replicates (default: 50). | |
| baseline_arrivals | No | Baseline arrival volume N (default: 1000). | |
| evaluation_budget | No | Total available evaluation budget (default: 1000.0). | |
| acceptance_capacity | No | Number of acceptance slots K (default: 200). | |
| unconventional_share | No | Prior share of unconventional/novel ideas (default: 0.10). | |
| ai_arrival_multiplier | No | Multiplier for synthetic/AI flood regime (default: 5.0). | |
| randomized_audit_budget_share | No | Share of budget allocated to randomized Horvitz-Thompson exploration audits (default: 0.05). |