load_model
Load a model into memory for inference, with optional keep-alive duration and provider selection.
Instructions
Load a model into memory so it is ready for inference. Optionally set keepAlive (e.g. '5m', '1h'). Without a provider arg, loads on every detected provider.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| model | Yes | Model id/name to load | |
| provider | No | Optional provider id | |
| keepAlive | No | How long to keep the model resident, e.g. '5m' |