generate_adversarial_tasks
Generate adversarial test tasks targeting LLM failure modes like hallucination, prompt injection, and reasoning errors, including expected behaviors for automated evaluation.
Instructions
Génère des tâches de test adversariales pour éprouver un agent LLM.
Appelle cet outil quand tu veux construire un jeu de tests ciblant un mode de défaillance précis (hallucination, injection de prompt, non-respect des consignes, sortie dangereuse, erreur de raisonnement, mauvais usage d'outil). Chaque tâche inclut le comportement attendu, qui sert de référence au juge.
Args: category: La famille de défaillance à cibler. count: Nombre de tâches à générer (entre 1 et 50). Par défaut 5.
Returns: La liste des tâches adversariales annotées.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| count | No | ||
| category | Yes |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| result | Yes |