t2000_chat
Run private inference on confidential compute via OpenAI-compatible chat. Send a prompt or message list to generate responses, billed to your credit.
Instructions
Run private inference on t2000 Private Inference (OpenAI-compatible; ZDR by default, a phala/* tier is GPU-TEE confidential), billed to the user's t2000 credit. Requires T2000_API_KEY in the server env (mint one at agents.t2000.ai/manage). Pass a single prompt, or a full messages list. Discover model ids with t2000_models; defaults to the fast gpt-oss-120b.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| model | No | Model id (default openai/gpt-oss-120b; see t2000_models) | |
| prompt | No | User prompt (shorthand for a single user message) | |
| messages | No | Full message list (overrides `prompt` when present) | |
| maxTokens | No | Max output tokens | |
| temperature | No | Sampling temperature (0–2) |