agentseed
️ AgentSeed
Barreras de protección contra las alucinaciones para agentes de codificación con IA.
Un plugin híbrido de Agent Plugins (Skill + MCP Server) que fuerza el desarrollo dirigido por especificaciones y verifica el código antes de marcarlo como termiado — de modo que «Done, all tests pass» se convierte en un hecho observado, no en una merafirma.
⭐ ¿Te gusta este proyecto? Considera diear una estrella — ayuda a los desarralladores a encontrar barreras de protección antes de publicar código alucinado.
Por qué AgentSeed
Los LLM alucinan — en el código, eso signfica APIs inventadas, identificaradores no definidos, pasadas de tests falsas, y afirmaciones demasiado concidades. Los números:
el 15,1 % de las alucinaciones de código entran en conflicto: apical a APIs que no exiten o que se importaron nunca (arXiv:2404.00971).
Menos del 10 % de los cóigos alucinados fallan los tests — la mayoría se alta de la CI (arXiv:2404.00971).
Más del 60 % de los erroores de salida de los modelos son no verificales: no hay for de distear la realidad de la ficción (FAVA, citado en SoK).
Las barreras de solo prompts son blandas: un modelo puede aceptar verifical y luego sáltarselo. AgentSeed fija la instrucción a una compuerta MCP real — la evidencia proviene de ejecutación de código, no del0028n del autoinforme del modelo.
Ll gen two vacíos que la especificación 1.0.0 deja deliberadamente abiertos:
Vacío en Agent Plugins 1.0.0 | Lo que hace AgentSeed |
No hay sistema de aplicación (las skills son opcionales de seguir) | hace |
No hay linter de conformación oficial |
|
Related MCP server: Metsuke
Qué hace
Seis herramientas MCP — con cero dependencies requeridas, aceptadas por extras opcionales:
Herramienta | De tęcta | Técnica |
| APIs inventadas / símbolos no identifados | Python AST + pasada léxica TS/JS |
| Código placeholder, afirmaciones efectos, contenido infented | 28+ seesales sobr, 3 group |
| Emp aqueado de plugins no conforme |
|
| «Los tests pasan» sin expedir ninguna duction | Deterministic execution channel |
| "Salida estructurada no válida" | Validación de schema |
| Evidencia no persistente | Añade entry de auditoría en |
Evaluado sobr e un corpus sintético seedado (5 de classes de defectos): precisión 1.0, exhausta 1.0 (tp=100, fp=0, fn=0) con el test de regresión que lo garantiza. all detail in docs/BENCHMARK.md.
Demo en vivo
$ verify_code(source="def f():\n return magic_unknown()\n", language="python")
{
"language": "python",
"suspects": ["magic_unknown"] # ← hallucinated API caught
}
$ scan_hallucination(source="The feature is production ready, all tests pass. Trust me.")
{
"hits": [
{"word": "all tests pass", "group": "oversold", "line": 1},
{"word": "production ready", "group": "oversold", "line": 1},
{"word": "trust me", "group": "oversold", "line": 1}
],
"clean": false # ← overclaim caught
}
$ check_plugin(path="/path/to/AgentSeed")
{ "ok": true, "errors": [], "warnings": [] } # ← strict 1.0.0 conformanceInicio rápido
Option A — descargar un release (sin make falta git):
# grab the latest asset from https://gitcode.com/badhope/AgentSeed/releases
# or use the installer, which drops it into a client of your choice:
bash install.sh --client auto # macOS / Linux
./install.ps1 -Client auto # Windows PowerShell
# --client: claude | opencode | cursor | manualOption B — clonar el repo:
git clone https://gitcode.com/badhope/AgentSeed.git
# or: https://gitcode.com/badhope/AgentSeed · https://gitee.com/badhope/AgentSeedDrop the
AgentSeed/directory in any client that supports Agent Plugins (Cursor, VS Code, Claude Code, Copilot…). No compilla ni instalina; cero dependencies requeridas (extras in opcional des abajo).El cliente autom measure
verify-before-codeskill andagentseedserver fromplugin.json+mcp.json.Y là lo tienes. Now now blow. The skill gate all coding tasks: contract → implementation → verification → evidence.
Ejecútalo por su cuenta para una auto-comprobación:
python3 server/guard_engine.py # self-check: demo verify_code + scan_hallucination
python3 -m unittest discover -s server # 90+ unit tests (also: `pytest` in CI)Pass to a human PR the same rules (CI):
python3 server/guard_cli.py gate --root . # composite hard gate: conformance
# + symbols + baseline scan, exit 1 on any failure
python3 server/guard_cli.py check . --ci # plugin conformance only, exit 1 on errors
python3 server/guard_cli.py scan src/ --strict # hallucination scan, blocking severities onlyWindows notice:
encaras viapython3. In many Windows,aleis a Microsoft Store shim; if fails, cambiacommandoto["python", "server/guard_servidor.py"]` or apúntalo to the absolute path of your interpreter.
Dependencies encend opcionales
Agent works only with the Python standard library. Install to upgrades two tools to world-class engines (auto detected, graceful default both modes):
pip install -r server/requirements.txtExtra | Upgrade | Without it |
|
| built-in integration |
|
| built-in AST walk |
| SKILL.md frontmatter parsing → full YAML | built-in lite parser |
Use an absolute path to
guard_server.py; server rest all from own directory, no extra cwd.
Same & graceful descending
AgentSeed adapts to what the host: decreasing one level a time — never skipping verification:
| Host capability | What you get | Setup |
Capability: Host | What you get | Setup |
Agent Plugins complet | directo: skill + MCP auto-discovered, ${PLUGIN_DATA} config. | nobedly directory |
MCP-capable client | all 6 tools via registration | exact snippet above |
Skills-only client | skill workflow; verication degrades to | flat skills/verify-before-code |
Terminal / CI / no agent | CLI gate t uses exits | ** |
The skill itself has fallback: when MCP absent, it instructs agent to execute guard_cli.py verify/scan via shell and use same blocking rules to exit codes.
Plataformas supported
| Client | Agent Plugins 1.0.0 | Status | Notes |
|Claude Code | skills + MCP config | compatible | skills via ~/.claude/skills, server via claude mcp add |
|opencode | skills + MCP config | compatible | ~/.config/opencode/opencode.json — exact snip below |
|Curso for | skills + mcp.json | untested* | copy to project; no stable plugin |
|VS Code (+Copilot) | MCP support rollout | untested* | Use mcp. json keys as is |
|Cline / Windsorf | MCP config | untested* | stdio server |
* honesto: los formatos are spec-rex and expected to work, but we haven't been able to test AgentSeed by ourselves. Verificado = actual during the dependencies. If you comfirm one, open a PR updating that chart.
The client honoring the full spec also set ${PLUGIN_DATA}; AgentSeed reads from there a agentseed.config.json.
Configuración/
|Key| Path | Efecto |
|Key | Type |
| allowlist | string[] | Scan exclusions (replaces the built-in test-idiom) |
| severities | {grupo: error\|warning\|info} | overrides seriousness per group |
| timeout | int | default sandbox_run timeout in seconds (clamped 1 sec) |
| extra_tokens | {grupo: string[]} | expand the pool at runtime |
| } |
| suppress_symbols | string[] | all that verify_code never marks (reported in 'suppressed) | | sandbox_allowed_prefixs|string[]| **allowist of executables thatsandbox_run can start (absent=no restrictions). Entrées without separator: match name after PATH (pythonalso accepts.exe); With separator: Path-resolved path or a prefix of them (at line) | |sandbox_env|"inherit"|"scrub"|"|s" | sandbox_env child process, scrub deletes words with credentials (TOKEN...API\_KEY) before,denyl, not a security boundary |
| Seconds are detected by stderr; typo keys are never silenced.
Language coverage (honested scope)
Idioma | análisis de |
Python | recorrido completo del ámbito AST (+ pyflakes cuando está instalado), números de línea |
TypeScript / JavaScript | paso léxico de regex (clases de falsos positivos documentadas) |
Go / Java / Rust / C/C++ / otros | aún no analizados — devuelve un resultado vacío |
⚠️ Nota de seguridad:
sandbox_runejecuta procesos reales con los permisos de tu usuario. Los clientes deben restringirlo detrás de la aprobación del usuario; establecesandbox_allowed_prefixesen entornos compartidos/CI. Cuando hay una lista de permitidos configurada, los comandos se resuelven a través dePATHhasta su ruta absoluta antes de la ejecución: un directorio de trabajo hostil no puede ocultar un nombre base permitido con un ejecutable plantado, y los comandos sin coincidencia o no resolubles se rechazan (salida -10) sin ejecutarse.
Configuración del cliente — configuración exacta
AgentSeed tiene dos mitades; ambas son necesarias para el control completo:
Skill (
skills/verify-before-code/) — enseña al agente el flujo de trabajo.Servidor MCP (
server/guard_server.py) — proporciona las 6 herramientas.
Los instaladores conectan el paso 1 e imprimen el paso 2 para tu cliente. Configuración manual:
Claude Code
# skill: copy it flat so SKILL.md sits directly in the folder
cp -R skills/verify-before-code ~/.claude/skills/verify-before-code
# MCP server:
claude mcp add agentseed -- python /path/to/AgentSeed/server/guard_server.pyopencode — copia skills/verify-before-code/ a
~/.config/opencode/skill/verify-before-code, y luego agrega a opencode.json:
{
"mcp": {
"agentseed": {
"type": "local",
"command": ["python", "/path/to/AgentSeed/server/guard_server.py"],
"enabled": true
}
}
}Curso / otros clientes MPC — registra un servidor cstdio con
command: python, args: ["/ipth/to/AgentSeed/server/guard_server.py"],
y copia la carpera destillgg según la ubicación de los skil de tu cliente.
Usa una ruta absoluta a
guard_server.py; el servidor resuelve todo lo demás desde su proia ubicación, así que no se requiere un cwd especial.
Historial de cambios
Consulta el CHANGELOG.md.
Biblioteca integrada de salvaguardes (EN / 中文 / 日本語)
Recurso | Contenido |
| 20+ preguntas de barrera para copiar y pegar: evidencia de completado, verificar-antes-de-dedicir, incertidumbre, verificación de API, convenciones de citas… |
| Catálogo de modos de fallo: taxonomía de corte en 5 clases + hallazgos de SoK + casos judiciales/chat reales |
| Lista de verificación ejecutable al final de la tarea: clase de riesgo → contrato → evidencia → auditoría de lenguaje |
| El contrato que debe cumplir toda tarea de código |
| Mapa de adopción de técnicas de proveedores (Anthropic, OpenAI, AWS, NVIDIA, IBM, Guardrails AI, Vectra) |
Cómo funciona el control
Antes de codificar — carga el contrato de SDD, exprésalo en una frase.
Implementar — sol código real: sin plantillas de relleno, rein APIs ningunas.
Antes de «done» — llama a
verify_code+scan_hallucination; demueba las afirmaciones de ejecución consandbox_run; valida la estructura conschema_validate.Audoría de lenguaje — los informes de finalización adjutan evidencia; el vocabulario de sobredecrición está prohibido.
Solo cuando todas las vérifias iesapasan se puede marcarla tarea como completa.
Las normnas impuestas (cómo se concentiona ala AI)
El skill no sóolo sugere comportamiento — cada norme se asoci a un control que observa el cumplimento:
Normative | Enforzado por |
Contrato antes dele code (u/objetiv/objetivo... etc.) | Control 1 de |
No inventar APIs — nunca llamar a un símbolo indefinido |
|
Solo implementaciones reales — ser plantillas/placeholds/tes | señales de stubs |
Verificación antes de una la completción — ejecútalo, lueggo dílo | Control 3 + exit codos |
Informes con evidencia — línes que leeyó, salida que vio | Control 4 audadoría + |
Más pequeño diff, sin rejards de enrautado; surface ambigüedad, preguntá una vez | no-metas del contrato + |
Estos se sinteganzaron de lo que los operadores de agentes fuertes han convergido púlicamente —
AGENTS.md standar abiorta, best practices del CClaude Code de Anthropic, y disciplinas de communidad como FerroLabs/agents-md
(poctura de senior-engineering, anti-sycophancy, loop forserdo de vérif). La diferencia: ****allá not prosa; aquí cada normazine/control enforcement.
** Tabla compreta con rute señarria:
skills/verify-before-code/references/DEFAULT-NORMS.md.
Fuunciona junto a tus/configs de agente
AgentSeed complementa — no reemplaza — los archivos de contexto que tu equipo utilized with agentes de code de IA (CLAUDE.md, AGENTS.md, .curs/rules/, .gith/cill instructions.s, CONTRIBUTING.md conventiones):
Esos archivos llevan facts: stack, comandos, layout, style. Sin embargo son prosai.
AgentSeed lleva el contrato de comportamiento: y la ejecución. :hallucination, verification, evidéncias — hard MPC tools plus CI exit code beyond.- One true source per concern: directere your
AGENTS.mdat these knormas instead of copy; when plugin updates and norm holds.
Por qué AgentSeed versus alternatives
Sólo-guía (e.g., superpower) | Estático import linters (MCP) | AgentSeed | |
Touch code | prompt only | importar gráfico análisis | ✅ AST + lexical analysis |
Verification tools | ❌ | lint gates (partial) | ✅ 6 tools MCP incl. sandboxed execution |
Hallucination-language scan | ❌ | ❌ | ✅ stub / over inventor&fabric signals (EN + CJK) |
Enforcement | soft (skill) | CI program | hard gate: skill + MCP + CLI exit codes |
Agent Plugins 1.0.0 conforms | ❌ | ❌ | ✅ primric first |
Roadmap
Hybrid Skill + MCP response, 6 tools — first strict 1.0.0 linter
Prompt pool + pattern library + grouped signals + vendor map
verify_codeTypeScript / JavaScript (zero-dependency pasión lexical)verify_codefor GoGrammar-constrained decoding for structured output
Optional remote fact-checker (HHEM-style) MCP server
FAQ
Does it need a specific LLM? No — agnostic on client & model. The control is exercised by the skill + MCP server, not by any model.
Zero dependencies? Yes. The entire MCP server are Python std-lib only.
Conformant? check_plugin validats the plugin against the spec (membership) — and AgentSeed passes its own linter (ok: true).
9. Contributing
Issues, PRs even welcome. See Roadmap or open an issue for a pattern we haven't covered.
License
Apache-2.0 © AgentSeed. See LICENSE.
⭐ If AgentSeed has saved you from delivering hallucinated code, star the repo — it's the most signal that guardrails make a difference.
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- AlicenseDqualityDmaintenanceSpec-driven development tool for AI coding assistants that generates specs, validates code compliance, and provides actionable feedback.1129MIT
- AlicenseNot gradedqualityBmaintenanceProvides SDLC compliance verification as tools that AI agents can invoke, continuously monitoring and evaluating development processes.MIT

corbatofficial
AlicenseAqualityBmaintenancePolicy and quality engine for AI coding agents that enforces team coding standards and provides validation gates for agent-assisted software delivery.7624MIT
Rigour MCPofficial
AlicenseNot gradedqualityBmaintenanceEnables AI agents to self-govern by scanning code for hardcoded secrets, structural violations, and AI drift in real-time, providing fix packets for automatic remediation.26MIT
Related MCP Connectors
33 tools that make AI write, implement, and verify intent against explicit, testable constraints.
Lints + auto-fixes how AI coding agents discover any new product. 24 rules, 6 tools, score 0-100.
See, price, and control every tool call your AI agents make: policy checks, cost, and audit tools.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/Morningstar202604/AgentSeed'
If you have feedback or need assistance with the MCP directory API, please join our Discord server