Agent Business Lab
Click on "Deploy Server".
Wait a few minutes for the server to deploy. Once ready, it will show a "Started" state.
In the chat, type
@followed by the MCP server name and your instructions, e.g., "@Agent Business LabRun the quote-followup scenario and score whether my agent passed."
That's it! The server will respond to your query, and you can continue using it as needed.
Here is a step-by-step guide with screenshots.
Agent Business Lab
Un laboratoire MCP local pour mesurer le résultat métier d'un agent, avec des données entièrement synthétiques. Quatre scénarios vérifient une relance de devis sans doublon, un rappel de facture non envoyé, la séparation entre dossiers clients et une rupture de stock. Le score vient de l'état final et des tentatives enregistrées, pas du texte de l'agent.
Essayer
node src/cli.js scenarios
node src/cli.js init quote-followup demo.state.json
node src/cli.js serve demo.state.json
node src/cli.js score demo.state.json
npm testLa commande serve est un serveur MCP sur stdio. Configurez votre client MCP pour lancer node avec src/cli.js serve et le chemin absolu du fichier d'état. Donnez à l'agent la consigne affichée par scenarios dans la langue voulue. Les outils et descriptions sont disponibles en français, anglais et espagnol. Initialisez un fichier neuf pour chaque essai.
Le score retourne le code 0 pour une réussite et 2 pour un échec. Les données sont fictives ; ce dépôt ne se connecte ni à incwo ni à Bruno. Pour comparer plusieurs agents, utilisez le même scénario et des états réinitialisés. Les scénarios ne prétendent pas certifier une plateforme ni couvrir toutes les règles commerciales.
OpenClaw et Hermes peuvent lancer un serveur MCP stdio. Les agents cloud nécessitent un transport compatible ou un adaptateur hébergé : aucun accès direct à Muse, aux dots ou à OCE n'est inclus dans cette première version.
Licence MIT.
This server cannot be deployed
Maintenance
Related MCP Connectors
MCP server providing access to the Scorecard API to evaluate and optimize LLM systems.
MCP server for building and testing AI agents with multi-model experimentation and insights.
Remote MCP server for supportsheep: run AI interviews and manage support content for your blog.
Pay-per-call AI evaluation MCP server. Score LLM outputs against benchmark rubrics via Workers AI.
Related MCP Servers
- AlicenseAqualityCmaintenanceA local MCP server that packages LLM evaluation gates as reusable CI/CD primitives, enabling AI agents to run datasets against models, score responses, and enforce quality thresholds.10MIT
- AlicenseBqualityDmaintenanceAn MCP-style stdio server for evaluating AI agent outputs, enabling CI-friendly quality gates, regression comparisons, and canary promotion decisions.3MIT
- AlicenseNot gradedqualityAmaintenanceServes offline document validation and evaluation operations of the Judgment Pack Specification to MCP clients over stdio, enabling agents to validate and evaluate JPS documents as tool calls. Supports conformance validation, experimental evaluation with disposition and error classes, and corpus testing.2Apache 2.0
- FlicenseNot gradedqualityBmaintenanceExposes a stdio-based MCP server with seven tools for running a simulated quality-orchestration pipeline, enabling pipeline execution and tracing without consuming tokens.-