Skip to main content
Glama

️ AgentSeed

Barreras de protección contra las alucinaciones para agentes de codificación con IA.

Un plugin híbrido de Agent Plugins (Skill + MCP Server) que fuerza el desarrollo dirigido por especificaciones y verifica el código antes de marcarlo como termiado — de modo que «Done, all tests pass» se convierte en un hecho observado, no en una merafirma.

Licencia Versión CI Plataformas

English · 中文 · 日本語

¿Te gusta este proyecto? Considera diear una estrella — ayuda a los desarralladores a encontrar barreras de protección antes de publicar código alucinado.


Por qué AgentSeed

Los LLM alucinan — en el código, eso signfica APIs inventadas, identificaradores no definidos, pasadas de tests falsas, y afirmaciones demasiado concidades. Los números:

  • el 15,1 % de las alucinaciones de código entran en conflicto: apical a APIs que no exiten o que se importaron nunca (arXiv:2404.00971).

  • Menos del 10 % de los cóigos alucinados fallan los tests — la mayoría se alta de la CI (arXiv:2404.00971).

  • Más del 60 % de los erroores de salida de los modelos son no verificales: no hay for de distear la realidad de la ficción (FAVA, citado en SoK).

Las barreras de solo prompts son blandas: un modelo puede aceptar verifical y luego sáltarselo. AgentSeed fija la instrucción a una compuerta MCP real — la evidencia proviene de ejecutación de código, no del0028n del autoinforme del modelo.

Ll gen two vacíos que la especificación 1.0.0 deja deliberadamente abiertos:

Vacío en Agent Plugins 1.0.0

Lo que hace AgentSeed

No hay sistema de aplicación (las skills son opcionales de seguir)

hace skill inesquible

No hay linter de conformación oficial

check_plugin es el primer linter estricto 1.0.0

Related MCP server: Metsuke

Qué hace

Seis herramientas MCP — con cero dependencies requeridas, aceptadas por extras opcionales:

Herramienta

De tęcta

Técnica

verify_code

APIs inventadas / símbolos no identifados

Python AST + pasada léxica TS/JS

scan_hallucination

Código placeholder, afirmaciones efectos, contenido infented

28+ seesales sobr, 3 group

check_plugin

Emp aqueado de plugins no conforme

Linter estricto 1.0.0

sandbox_run

«Los tests pasan» sin expedir ninguna duction

Deterministic execution channel

identification no

"Salida estructurada no válida"

Validación de schema

record_verification

Evidencia no persistente

Añade entry de auditoría en PLUGIN_DATA

Evaluado sobr e un corpus sintético seedado (5 de classes de defectos): precisión 1.0, exhausta 1.0 (tp=100, fp=0, fn=0) con el test de regresión que lo garantiza. all detail in docs/BENCHMARK.md.

Demo en vivo

$ verify_code(source="def f():\n    return magic_unknown()\n", language="python")
{
  "language": "python",
  "suspects": ["magic_unknown"]      # ← hallucinated API caught
}

$ scan_hallucination(source="The feature is production ready, all tests pass. Trust me.")
{
  "hits": [
    {"word": "all tests pass", "group": "oversold", "line": 1},
    {"word": "production ready", "group": "oversold", "line": 1},
    {"word": "trust me", "group": "oversold", "line": 1}
  ],
  "clean": false                      # ← overclaim caught
}

$ check_plugin(path="/path/to/AgentSeed")
{ "ok": true, "errors": [], "warnings": [] }   # ← strict 1.0.0 conformance

Inicio rápido

Option A — descargar un release (sin make falta git):

# grab the latest asset from https://gitcode.com/badhope/AgentSeed/releases
# or use the installer, which drops it into a client of your choice:
bash install.sh --client auto        # macOS / Linux
./install.ps1 -Client auto           # Windows PowerShell
# --client: claude | opencode | cursor | manual

Option B — clonar el repo:

git clone https://gitcode.com/badhope/AgentSeed.git
# or: https://gitcode.com/badhope/AgentSeed · https://gitee.com/badhope/AgentSeed
  1. Drop the AgentSeed/ directory in any client that supports Agent Plugins (Cursor, VS Code, Claude Code, Copilot…). No compilla ni instalina; cero dependencies requeridas (extras in opcional des abajo).

  2. El cliente autom measure verify-before-code skill and agentseed server from plugin.json + mcp.json.

  3. Y là lo tienes. Now now blow. The skill gate all coding tasks: contract → implementation → verification → evidence.

Ejecútalo por su cuenta para una auto-comprobación:

python3 server/guard_engine.py              # self-check: demo verify_code + scan_hallucination
python3 -m unittest discover -s server      # 90+ unit tests (also: `pytest` in CI)

Pass to a human PR the same rules (CI):

python3 server/guard_cli.py gate --root .    # composite hard gate: conformance
                                             # + symbols + baseline scan, exit 1 on any failure
python3 server/guard_cli.py check . --ci     # plugin conformance only, exit 1 on errors
python3 server/guard_cli.py scan src/ --strict   # hallucination scan, blocking severities only

Windows notice: encaras via python3. In many Windows, aleis a Microsoft Store shim; if fails, cambiacommandoto["python", "server/guard_servidor.py"]` or apúntalo to the absolute path of your interpreter.

Dependencies encend opcionales

Agent works only with the Python standard library. Install to upgrades two tools to world-class engines (auto detected, graceful default both modes):

pip install -r server/requirements.txt

Extra

Upgrade

Without it

jsonschema

schema_validate → complete Draft 2024-12

built-in integration

pyflakes

verify_code → pyflakes F821 defaults-name analysis

built-in AST walk

pyyaml

SKILL.md frontmatter parsing → full YAML

built-in lite parser

Use an absolute path to guard_server.py; server rest all from own directory, no extra cwd.

Same & graceful descending

AgentSeed adapts to what the host: decreasing one level a time — never skipping verification:

| Host capability | What you get | Setup |

Capability: Host

What you get

Setup

Agent Plugins complet

directo: skill + MCP auto-discovered, ${PLUGIN_DATA} config.

nobedly directory

MCP-capable client

all 6 tools via registration

exact snippet above

Skills-only client

skill workflow; verication degrades to guard_cli.py via shell**

flat skills/verify-before-code

Terminal / CI / no agent

CLI gate t uses exits

**python server/guard_cli.py check -- all.

The skill itself has fallback: when MCP absent, it instructs agent to execute guard_cli.py verify/scan via shell and use same blocking rules to exit codes.

Plataformas supported

| Client | Agent Plugins 1.0.0 | Status | Notes | |Claude Code | skills + MCP config | compatible | skills via ~/.claude/skills, server via claude mcp add | |opencode | skills + MCP config | compatible | ~/.config/opencode/opencode.json — exact snip below | |Curso for | skills + mcp.json | untested* | copy to project; no stable plugin | |VS Code (+Copilot) | MCP support rollout | untested* | Use mcp. json keys as is | |Cline / Windsorf | MCP config | untested* | stdio server |

* honesto: los formatos are spec-rex and expected to work, but we haven't been able to test AgentSeed by ourselves. Verificado = actual during the dependencies. If you comfirm one, open a PR updating that chart.

The client honoring the full spec also set ${PLUGIN_DATA}; AgentSeed reads from there a agentseed.config.json.

Configuración/

|Key| Path | Efecto | |Key | Type | | allowlist | string[] | Scan exclusions (replaces the built-in test-idiom) | | severities | {grupo: error\|warning\|info} | overrides seriousness per group | | timeout | int | default sandbox_run timeout in seconds (clamped 1 sec) | | extra_tokens | {grupo: string[]} | expand the pool at runtime | | } | | suppress_symbols | string[] | all that verify_code never marks (reported in 'suppressed) | | sandbox_allowed_prefixs|string[]| **allowist of executables thatsandbox_run can start (absent=no restrictions). Entrées without separator: match name after PATH (pythonalso accepts.exe); With separator: Path-resolved path or a prefix of them (at line) | |sandbox_env|"inherit"|"scrub"|"|s" | sandbox_env child process, scrub deletes words with credentials (TOKEN...API\_KEY) before,denyl, not a security boundary | | Seconds are detected by stderr; typo keys are never silenced.

Language coverage (honested scope)

Idioma

análisis de verify_code

Python

recorrido completo del ámbito AST (+ pyflakes cuando está instalado), números de línea

TypeScript / JavaScript

paso léxico de regex (clases de falsos positivos documentadas)

Go / Java / Rust / C/C++ / otros

aún no analizados — devuelve un resultado vacío

⚠️ Nota de seguridad: sandbox_run ejecuta procesos reales con los permisos de tu usuario. Los clientes deben restringirlo detrás de la aprobación del usuario; establece sandbox_allowed_prefixes en entornos compartidos/CI. Cuando hay una lista de permitidos configurada, los comandos se resuelven a través de PATH hasta su ruta absoluta antes de la ejecución: un directorio de trabajo hostil no puede ocultar un nombre base permitido con un ejecutable plantado, y los comandos sin coincidencia o no resolubles se rechazan (salida -10) sin ejecutarse.

Configuración del cliente — configuración exacta

AgentSeed tiene dos mitades; ambas son necesarias para el control completo:

  1. Skill (skills/verify-before-code/) — enseña al agente el flujo de trabajo.

  2. Servidor MCP (server/guard_server.py) — proporciona las 6 herramientas.

Los instaladores conectan el paso 1 e imprimen el paso 2 para tu cliente. Configuración manual:

Claude Code

# skill: copy it flat so SKILL.md sits directly in the folder
cp -R skills/verify-before-code ~/.claude/skills/verify-before-code
# MCP server:
claude mcp add agentseed -- python /path/to/AgentSeed/server/guard_server.py

opencode — copia skills/verify-before-code/ a ~/.config/opencode/skill/verify-before-code, y luego agrega a opencode.json:

{
  "mcp": {
    "agentseed": {
      "type": "local",
      "command": ["python", "/path/to/AgentSeed/server/guard_server.py"],
      "enabled": true
    }
  }
}

Curso / otros clientes MPC — registra un servidor cstdio con command: python, args: ["/ipth/to/AgentSeed/server/guard_server.py"], y copia la carpera destillgg según la ubicación de los skil de tu cliente.

Usa una ruta absoluta a guard_server.py; el servidor resuelve todo lo demás desde su proia ubicación, así que no se requiere un cwd especial.

Historial de cambios

Consulta el CHANGELOG.md.

Biblioteca integrada de salvaguardes (EN / 中文 / 日本語)

Recurso

Contenido

PROMPT-POOL

20+ preguntas de barrera para copiar y pegar: evidencia de completado, verificar-antes-de-dedicir, incertidumbre, verificación de API, convenciones de citas…

HALLUCINATION-PATTERNS

Catálogo de modos de fallo: taxonomía de corte en 5 clases + hallazgos de SoK + casos judiciales/chat reales

VERIFACIÓN-CHECKLIST

Lista de verificación ejecutable al final de la tarea: clase de riesgo → contrato → evidencia → auditoría de lenguaje

SDD-CONTRACT

El contrato que debe cumplir toda tarea de código

VENDOR SOLUTIONS

Mapa de adopción de técnicas de proveedores (Anthropic, OpenAI, AWS, NVIDIA, IBM, Guardrails AI, Vectra)

Cómo funciona el control

  1. Antes de codificar — carga el contrato de SDD, exprésalo en una frase.

  2. Implementar — sol código real: sin plantillas de relleno, rein APIs ningunas.

  3. Antes de «done» — llama a verify_code + scan_hallucination; demueba las afirmaciones de ejecución con sandbox_run; valida la estructura con schema_validate.

  4. Audoría de lenguaje — los informes de finalización adjutan evidencia; el vocabulario de sobredecrición está prohibido.

  5. Solo cuando todas las vérifias iesapasan se puede marcarla tarea como completa.

Las normnas impuestas (cómo se concentiona ala AI)

El skill no sóolo sugere comportamiento — cada norme se asoci a un control que observa el cumplimento:

Normative

Enforzado por

Contrato antes dele code (u/objetiv/objetivo... etc.)

Control 1 de verify-before-code

No inventar APIs — nunca llamar a un símbolo indefinido

verify_code sospeca control

Solo implementaciones reales — ser plantillas/placeholds/tes

señales de stubs scan_hallucination

Verificación antes de una la completción — ejecútalo, lueggo dílo

Control 3 + exit codos sandbox_only

Informes con evidencia — línes que leeyó, salida que vio

Control 4 audadoría + record_verification JSONL

Más pequeño diff, sin rejards de enrautado; surface ambigüedad, preguntá una vez

no-metas del contrato + guard_cli gate de CI

Estos se sinteganzaron de lo que los operadores de agentes fuertes han convergido púlicamente — AGENTS.md standar abiorta, best practices del CClaude Code de Anthropic, y disciplinas de communidad como FerroLabs/agents-md (poctura de senior-engineering, anti-sycophancy, loop forserdo de vérif). La diferencia: ****allá not prosa; aquí cada normazine/control enforcement. ** Tabla compreta con rute señarria: skills/verify-before-code/references/DEFAULT-NORMS.md.

Fuunciona junto a tus/configs de agente

AgentSeed complementa — no reemplaza — los archivos de contexto que tu equipo utilized with agentes de code de IA (CLAUDE.md, AGENTS.md, .curs/rules/, .gith/cill instructions.s, CONTRIBUTING.md conventiones):

  • Esos archivos llevan facts: stack, comandos, layout, style. Sin embargo son prosai.

  • AgentSeed lleva el contrato de comportamiento: y la ejecución. :hallucination, verification, evidéncias — hard MPC tools plus CI exit code beyond.- One true source per concern: directere your AGENTS.md at these knormas instead of copy; when plugin updates and norm holds.

Por qué AgentSeed versus alternatives

Sólo-guía (e.g., superpower)

Estático import linters (MCP)

AgentSeed

Touch code

prompt only

importar gráfico análisis

✅ AST + lexical analysis

Verification tools

lint gates (partial)

✅ 6 tools MCP incl. sandboxed execution

Hallucination-language scan

✅ stub / over inventor&fabric signals (EN + CJK)

Enforcement

soft (skill)

CI program

hard gate: skill + MCP + CLI exit codes

Agent Plugins 1.0.0 conforms

✅ primric first

Roadmap

  • Hybrid Skill + MCP response, 6 tools — first strict 1.0.0 linter

  • Prompt pool + pattern library + grouped signals + vendor map

  • verify_code TypeScript / JavaScript (zero-dependency pasión lexical)

  • verify_code for Go

  • Grammar-constrained decoding for structured output

  • Optional remote fact-checker (HHEM-style) MCP server

FAQ

Does it need a specific LLM? No — agnostic on client & model. The control is exercised by the skill + MCP server, not by any model.

Zero dependencies? Yes. The entire MCP server are Python std-lib only.

Conformant? check_plugin validats the plugin against the spec (membership) — and AgentSeed passes its own linter (ok: true).

9. Contributing

Issues, PRs even welcome. See Roadmap or open an issue for a pattern we haven't covered.

License

Apache-2.0 © AgentSeed. See LICENSE.


If AgentSeed has saved you from delivering hallucinated code, star the repo — it's the most signal that guardrails make a difference.

A
license - permissive license
Not graded
quality - not tested
B
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • A
    license
    D
    quality
    D
    maintenance
    Spec-driven development tool for AI coding assistants that generates specs, validates code compliance, and provides actionable feedback.
    11
    29
    MIT
  • A
    license
    Not graded
    quality
    B
    maintenance
    Provides SDLC compliance verification as tools that AI agents can invoke, continuously monitoring and evaluating development processes.
    MIT
  • A
    license
    A
    quality
    B
    maintenance
    Policy and quality engine for AI coding agents that enforces team coding standards and provides validation gates for agent-assisted software delivery.
    7
    62
    4
    MIT
  • A
    license
    Not graded
    quality
    B
    maintenance
    Enables AI agents to self-govern by scanning code for hardcoded secrets, structural violations, and AI drift in real-time, providing fix packets for automatic remediation.
    26
    MIT

View all related MCP servers

Related MCP Connectors

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/Morningstar202604/AgentSeed'

If you have feedback or need assistance with the MCP directory API, please join our Discord server