estimate_llm_cost
Estimate monthly LLM API cost from tokens per request and request volume; get per-model monthly and per-request prices, cheapest first, with caveats.
Instructions
Price a workload across current frontier and open-weights models. Give tokens per request and monthly request volume; returns cost per request and per month for every model, cheapest first, with the caveats that move the number (batch discounts, prompt caching, intro pricing that expires).
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| filter | No | Optional substring to limit the table, e.g. 'claude' or 'gemini'. | |
| input_tokens | Yes | Input tokens per request (a typical chat turn is 1000-3000 with context). | |
| output_tokens | Yes | Output tokens per request (typically 200-800). | |
| requests_per_month | Yes | Requests per month. |