Skip to main content
Glama
louislaurent1

Kryve Agent Evaluation MCP

Kryve Agent Evaluation MCP

CI

Un serveur MCP local et open source pour concevoir des tests d’agents IA, noter une exécution et documenter les preuves avant d’accorder davantage d’autonomie.

Il expose trois outils en lecture seule :

  • generate_test_plan : construit des cas nominaux, ambigus et sensibles selon le niveau de risque ;

  • score_agent_run : note le résultat, les preuves, le respect des validations et le coût des corrections ;

  • evaluation_scorecard : renvoie les colonnes d’une scorecard réutilisable.

Installation

npm install
npm run build

Puis lance le serveur sur stdio :

npm start

Configuration d’un client MCP :

{
  "mcpServers": {
    "kryve-agent-eval": {
      "command": "node",
      "args": ["/chemin/vers/kryve-agent-eval-mcp/dist/src/index.js"]
    }
  }
}

Related MCP server: llamator-mcp-server

Tester avec MCP Inspector

npx @modelcontextprotocol/inspector node dist/src/index.js

Philosophie

Une démo réussie ne prouve pas qu’un agent est fiable. Le test doit mesurer un résultat attendu, conserver des preuves, détecter les actions hors permission et rendre visible le coût des corrections humaines.

Pour comprendre le protocole et choisir une infrastructure :

Le kit CSV complémentaire est disponible dans le dépôt Kryve Agent Evaluation Kit.

Limites

Le score est une grille opérationnelle simple, pas une certification. Adapte les cas, les seuils et les validations au risque réel de ton organisation.

Licence

MIT — Kryve Solutions.

A
license - permissive license
-
quality - not tested
A
maintenance

Maintenance

Maintainers
Response time
Release cycle
1Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • A
    license
    -
    quality
    C
    maintenance
    Provides advanced evaluation tools for assessing AI safety, alignment, and performance of LLM outputs. Enables programmatic evaluation of quality, safety metrics like toxicity and PII detection, and operational metrics including carbon footprint and cost estimation.
    4
    Apache 2.0
  • A
    license
    A
    quality
    B
    maintenance
    Enables AI assistants to interact with Coval's evaluation platform for launching and monitoring evaluation runs, managing agents and test sets, and retrieving evaluation metrics.
    18
    175
    1
    MIT

View all related MCP servers

Related MCP Connectors

  • Build, validate, and deploy multi-agent AI solutions from any AI environment.

  • Evaluate, benchmark, and simulate AI agents on the VerifyAX agent-evaluation platform.

  • Read-only tools over the Safer Agentic AI framework: 238 patterns + 14 heuristics.

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/louislaurent1/kryve-agent-eval-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server