timps_model_evaluator
Build LLM evaluation harnesses, adversarial test inputs, and RAGAS configurations to validate model performance under edge cases.
Instructions
Create evaluation harnesses, adversarial test inputs, and RAGAS config for LLM models.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| request | No | Plain-English task or context for the agent. | |
| language | No | Primary programming language (default: python). | python |