Skip to main content
Glama

6️⃣ AgentSeed

Антигаллюцинационные защитные барьеры для ИИ-агентов, пишущих код.

Гибридный плагин Agent Plugins (Skill + MCP Server), который приклеивает разработку по спец ификации и проверяет код до того, как он будет помечен как готовый — чтобы «Готово, все тесты проходят» стало наблюдаемым фактом, а not заявлением.

License Version CI Platforms

English · 中文 · 日本語

Нравится проект? Поставьте ему звезду — это помогает разработчикам находить защитные барьеры до того, как они выпустят галлюцинированный код.


Зачем AgentSeed

LLM галлюцинируют — в коде это означает выдуканные API, неопределённые идентификаторы, фальшивые прогоны тестов и самоуверенные преувеличения. Цифры:

  • 15,1% галлюцинаций в коде конфликтуют со знаниями: вызываются API, которые не существуют или никогда не были импортированы (arXiv:2404.00971).

  • менее 10% галлюцинированного кода падает на тестах — большая часть проскакивает мимо CI (arXiv:2404.00971).

  • 60%+ ошибок модельного вывода непроверяемы — нет способа отличить факт от вымысла (FAVA, цитируется в SoK).

Одни только промпты — это «мягкая» защита: модель может согласиться проверить, а затем пропустить проверку. AgentSeed привязывает инструкцию к жёсткому MCP-барьеру — доказательства берутся из выполнния кода, а не из самоотчёта модели.

Он также закрывает дыры, которые спецификация 1.0.0 сознательно оставляет открытыми:

Пробел в Agent Plugins 1.0.0

Что делает AgentSeed

Нет принуждающего механизма (следовать навыкам необязательно)

Навык verify-before-code делает проверку обязательной

Нет официального линтера на соответствие

check_pluginперв строich линтер версии 1.0.0

Related MCP server: Metsuke

Что это делает

Шесть MCP-инструментов — ноль обязательных зависимостей, расширяется опциональными дополнениями:

Инструмент

Ловит

Техника

verify_code

Выдуманные API / неопределённые символы

Python AST + лексический проход TS/JS

scan_hallucination

Кодsстгs, преувеличения, выдуманный контент

28+ сигналов в 3 группах

check_plugin

Несоответствующая упаковка плагина

Строгий линтер версии 1.0.0

sandbox_run

«Тесты проходят» без реального запуска

ДетерSминированный канал выполнения

schema_validate

Неправильный структурированный вывод

Валидация JSON Schema

record_verification

Нет постоянного следа доказательств

Добавляет запись JSONL-аудит в PLUGIN_DATA

На помеченном синтетическом к究amente (5 дефектных классов): точность 1,0, полнота 1,0 (tp=100, fp=0, fn=0) — результат закреплён регрессионным тестом. Методология и честные границы в docs/BENCHMARK.md.

Живое демо

$ verify_code(source="def f():\n    return magic_unknown()\n", language="python")
{
  "language": "python",
  "suspects": ["magic_unknown"]      # ← hallucinated API caught
}

$ scan_hallucination(source="The feature is production ready, all tests pass. Trust me.")
{
  "hits": [
    {"word": "all tests pass", "group": "oversold", "line": 1},
    {"word": "production ready", "group": "oversold", "line": 1},
    {"word": "trust me", "group": "oversold", "line": 1}
  ],
  "clean": false                      # ← overclaim caught
}

$ check_plugin(path="/path/to/AgentSeed")
{ "ok": true, "errors": [], "warnings": [] }   # ← strict 1.0.0 conformance

Быстрый старт

Вариант A — скачайте релиз (git не нужен):

# grab the latest asset from https://gitcode.com/badhope/AgentSeed/releases
# or use the installer, which drops it into a client of your choice:
bash install.sh --client auto        # macOS / Linux
./install.ps1 -Client auto           # Windows PowerShell
# --client: claude | opencode | cursor | manual

Вариант B — клонируйте:

git clone https://gitcode.com/badhope/AgentSeed.git
# or: https://gitcode.com/badhope/AgentSeed · https://gitee.com/badhope/AgentSeed
  1. Перетащите каталог AgentSeed/ в любой клиент, поддерживающий Agent Plugins (Cursor, VS Code, Claude Code, Copilot…). Собирать Bates, loadeb не нуде; обязаней dependencies нет (omмость optional extras ние).

  2. Клиент автоматически обнаруживает навык verify-before-code и MCP-сервер agentseed из plugin.json + mcp.json.

  3. Всё. Во — навык теперь стоит воротами перед каждой задачей написания кода: кон优雅 → implementation → verify → evidence.

Запустите в вычисленном автономно for 揚:

python3 server/guard_engine.py              # self-check: demo verify_code + scan_hallucination
python3 -m unittest discover -s server      # 90+ unit tests (also: `pytest` in CI)

Отправьте обы smell PR через те же пika (режим CI):

python3 server/guard_cli.py gate --root .    # composite hard gate: conformance
                                             # + symbols + baseline scan, exit 1 on any failure
python3 server/guard_cli.py check . --ci     # plugin conformance only, exit 1 on errors
python3 server/guard_cli.py scan src/ --strict   # hallucination scan, blocking severities only

Примечание для Windows: mcp.json з的없는 сервер через python3. На многих критических участках Windows этот псевдоним — стиб из Microsoft Store; если сервер не запускается, измените command на ["python", "server/guard_server.py"] или укаждите абсолютный путь к вашему интерпретатору.

Необязательные зависимости

AgentSeed запускается на одной только стандартной библиотеке Python. Установка дополнения обновляет два инструментов до индуst риальных движков (автобнаруживание, вемых вловов — graceful fallback в любом случае):

pip install -r server/requirements.txt

Пакет

Что обновляет

Без него

jsonschema

schema_validate → полная ваlidation Draft 2020-12

Встройнный под-yawber-subset-validator

pyflakes

verify_code → анализ неопределённых имён F821

Встройнный обход AST

pyyaml

reading frontmatter in SKILL.md → full YAML

Встройнный лёгкий парser

Используйте абсолютный путь к guard_server.py; сервер решает всb., в отношении собственного расположения, and специальная cwd не требуется.

Совместимость и деликатная деградация

Подстраивается подойство каждого environment the server, деградируя на один уровень за раз —так нормально, при этом не молчит about verified.

Возможность хост-plataформы

Что вы получаете

Настроить

Полный Agent Plugins

У вас нет билда: skill + MCP are automatically identified, ${PLUGIN_DATA} конфиг поддерживается

Скпир папку плагина

Клиент с поддержкой MCP

Все 6 инструментов через регистрацию

Точные 힌т выше

Клиент только со скилами

Workness流程; проверка вырожается в guard_cli.py через shell (инструкции по fallback содержатся в самом навыке)

Скопируйте skills/verify-before-code правильно

Терминал / CI / без агента вообще

CLI шлюз с exit codes

python server/guard_cli.py check . --ci

Сам навык carries the degradation path: когда MCP-инструменты недоступюdy, он предписвает агенту intoпла выполнить guard_cli.py verify/scan через shell и применяет те же блокирующие правила к код возврата.

Поддержка платфор

Клиент

Пнагин Agent Plugins 1.0.0

Status

Дополнение

Claude Code

skills + MCP configuration

:вдефал

skills через ~/.claude/skills, server if via claude mcp add 서버

opencode

skills + конфиг MCP

verified

~/.config/opencode/opencode.json — точнtы ниже

Cursor

skills + mcp.json

совместимо*

Капируйте в проект; стабл папки плагинов нет

VS Code (+Copilot)

MCP supportвается по pent

not проверино*

Введите MCP поля метки mcp.json

Cline / Windsurf

совместимый MCP config

не протест*

stdio server entry mapping directly

* честные новоsty: форматы spec-compatible and должен работать, но we not запусти AgentSeed и в этих клиентах. (status) — "Проверено" = вся actually -genировано поддерживающими. If у вас проscale: откроите PR об новой таблtицы.

Клиенты поной спецификации такаже уставливают ${PLUGIN_DATA}; AgentSeed из них from ветки agentseed.config.json.

Справочник конфигурации (agentseed.config.json)

Ключ

Tип

Эффект

allowlist

string[]

scan exclusions (заменяет встроенный список тестовых идиом)

severities

{group: error|warning|info}

Дерегруповале severity

timeout

integer

New sandbox_run timeout in seconds (в диапазопе 1–120)

extra_tokens

{group: string[]}

Расширить in runtime the wordssкал output (word hallowent)

suppress_symbols

string[]

no-ever-p... (of verify_code) Report: tell in suppressed

allowlist.Command prefix

string[]

список конкретных исполняемых файлов, which) can launch sandbox_run (absent = no do. Entries without path separator are matched against the command’s PATH-resolved parent name (python also accepts python.exe); entries WITH separator can be resolved — or must be directory-prefix of: resolved absolute path (boundary respected).

sandbox_env

"inherit" or "scrub"

child env policy: scrub removes variable names Types that take look like tokens (TOKEN/SECRET/PASSWORD/API_KEY/…). — best‑effort denylist, but не a security boundary.

Неизвестные ключи печади warned in written text — misspelled key never silently ignored.

Языковое покрытие (честные границы)

Язык

Анализ verify_code

Python

полный обход областей AST (+ pyflakes при установке), номера строк

TypeScript / JavaScript

лексический regex‑проход (документированные классы ложных срабатываний)

Go / Java / Rust / C/C++ / прочие

пока не анализируются — возвращается пустой результат

⚠️ Примечание по безопасности: sandbox_run выполняет реальные процессы с правами вашего пользователя. Клиенты должны закрывать его за подтверждением пользователя; устанавливайте sandbox_allowed_prefixes в общих/CI‑средах. Когда список разрешений настроен, команды резолвятся через PATH до абсолютного пути перед выполнением — враждебная рабочая директория не может подменить разрешённое базовое имя исполненым файлом, а несовпадgeführtые или необи провнные комады отклонение (код выхода): без выполнения.

Настройка клиента — точная конфигурация

AgentSeed имет две со котовы; обе нужны для полного контроля:

  1. Навык (skills/verify-before-code/) — обortчает агента раочому процессу.

  2. MCP‑сервер (ver/guard_server.py) — преdotставляет 6 инструментов.

Уsetén. Основной код считаво применяются... Hе мой. Стройки oneвает шаг 1 и вывои шак 2 для вашего клиента. Ручная настройка:

Claude Code

# skill: copy it flat so SKILL.md sits directly in the folder
cp -R skills/verify-before-code ~/.claude/skills/verify-before-code
# MCP server:
claude mcp add agentseed -- python /path/to/AgentSeed/server/guard_server.py

opencode — скопируйте skills/verify-before-code/ в ~/.config/opencode/skill/verify-before-code, затем добавьте в opencode.json:

{
  "mcp": {
    "agentseed": {
      "type": "local",
      "command": ["python", "/path/to/AgentSeed/server/guard_server.py"],
      "enabled": true
    }
  }
}

Cursor / другие MCP‑клиенты — зарегистрируйте stdio‑сервер с command: python, args: ["/path/to/AgentSeed/server/guard_server.py"], и скопируйте папку навыка в расположение навыков вашего клиента.

Используйте абсолютный путь к guard_server.py; сервер сам определяет всё остальное относительно своего расположения, поэтому специальная рабочая директория не нужна.

История изменений

См. CHANGELOG.md.

Встроенная библиотека защитных механизмов (EN / 中文 / 日本語)

Ресурс

Содержимое

PROMPT-POOL

20+ готовых защитных промптов: свидетельства завершилости, проверка до утверждения, неуверенность, проверка API, правила цитирования…

HALLUCINATION-PATTERNS

Каталог видов отказов: 5‑классовая таксономия кода + результаты SoK + реальные юридические/чат‑кейсы

VERIFICATION-CHECKLIST

Выполняемый контрольный список в конце задачи: класс риска → контракт → подтверждение → языковой аудит

SDD-CONTRACT

Контракт, которому должна удовлетворять каждая задача разработки кода

VERIFY-SOLUTIONS

Карта внедрения вендорских методов (Anthropic, Open, OpenAI, AWS, NVIDIA, IBM, Guardrails, Аналоги Vess.)

Как работает контроль

  1. Перед кодом — загрузите контракт SDD и изложи его тогда одним предложением.

  2. Реализация — только реальный код: без заглушек, без выдуманных API.

  3. Перед словом «done» — вызова очисткoдеocode + scan_hallucination; подтвердите runtime-заявления через sandbox_run; проверьте структуру через schema_validate.

  4. Языковой аудит — отчёты о завершение прикладывают доказательства; лексика, преувеличивающая результаты, запрещена.

  5. Только когда все проверки пройдены, задача может быть помечена как выполненная.

Принудительные нормы (как ограничивается ИИ)

Навык не просто предлагает поведение — каждая норма привязана к контролю, который следит за её соблюдением:

Норма

Чем обеспечивается

Контракт (цель / интерфейс / не‑цели / проверка) до кода

Гейт 1 в verify-before-code

Нет выдуманных API — никогда не вызывать неопределённый символ

Гейт подозрений verify_code

Только настоящие реализации — без заглушек/плейсхолдеров/фейков

Признаки заглушек в scan_hallucination

Проверка заявлений о готово — сначала запусти код, потом говори

Гейт 3 + коды выхода sandbox_run

Отчёты с доказательствами — file:line, которые вы прочитали, выход, который вы видели

Аудит гейта 4 + record_verification JSONL

Минимальный diff, без «проезжих» рефакторингов; покажите неоднозначность и спросите один раз

Не‑цели контракта + guard_cli gate в CI

Эти нормы синтезируют то, на чём публично сошлись сильные операторы агентов — открытый стандарт AGENTS.md, лучшие практики Claude Code от Anthropic и практики сообщества, такие как FerrooLabs/agents-md (позиция старшего инженера, анти‑подхалимаж, принудительные циклы проверки). Разница: там это проза; здесь каждая норма имеет обеспечивающий инструмент или код выхода. Полная таблица с обоснованием в DEFAULT‑NORMSSIL.md.

Совестная работа с вашими конфигурами:

AgentSeed дополан — не зажает — конфигуурные фајл, которые ваша command уже издржит для ИИ‑агентовр програмirty (CLAUDE.md, AGENTS.md, .cursor/rules/, .); |

  • Эти файлы carrying facts about the stack, от команды, структура, стиль. Они — в тексте, but soft.

  • AgentSeed carries the behavioral contract and enforcement: detection hallucinations, verification gates, evidence chains — жёсткие MCP‑инstruments и тажёные; exit codes CI cannot ignores.

  • Держите один источник истины по каждому вопросу: направляйте свой AGENTS.md на нормы этого навыка, а не копируйте их; плагин обновляется, а норма остаётся обязательной.

Гдеревнение | Agent Seed vs alternatives

Their| |т их | ... |

We'll maybe skip weird data and correct to Russian proper.

Continuing:

Почему «AgentSeed» — vs. alternative

Только по правым скилнты (e.gг. superpowers)

Стандартные import linteres (MCP)

AgentSeed

Код касается

❌ только промпт

✅ анализ графа импортов

✅ AST + лексический анализ

Запускает проверочных инструментов

✅ линт‑гейты

✅ 6 MCP: tools incl. sand­danBox execution

Скан-галлюцин.: language

✅ стubs/over‑sold/fabricated сигналы (EN+ / CJK)

Enforcement(принуждение)

soft (skill text)

CI‑gate гейт

hard gate: одержимость + MCP + codes CLI

Agent Plugin 1.0.0 соnformance linter

✅ первый

Roadmap

  • Hybrid Skill + MCP‑protection, 6 tools — first strict 1.0.0 Lint;

  • [t] tool+ pattern + grouped signals + vendor techniques;

  • library verify-code for TypeScript /JavaScript (non-dependency lexical path);

  • [] verify_code for Go;

  • [] grammar‑constrained decoding for structured output;

  • timed optional remote fact‑checking (HHEM‑style) MCP‑server.

FAQ

Нужен ли какой‑то спецvital LLM? Нет — сборка doesn't depend on client or model. Protection is provided by the skill + MCP server, no model.

Zero–dependencies? Whole MCP service is a pure Python standard library.

Does it conform? check_plugin validates plugin per spec (§5/§6/§7) — and AgentFiles passes its own linter (ok: true).

Contributing

Issues, PRs and ideas welcome. See the roadmap for next steps — or open an issue if you find an unrecovered hallucination pattern.

License

Apache‑2.0 © AgentSeed. See LICENSE for details.


** If AgentSeed has saved you from shipping hallucinary code, give it a Github star — it's the best signal that guardrails matter. **

A
license - permissive license
Not graded
quality - not tested
B
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • A
    license
    D
    quality
    D
    maintenance
    Spec-driven development tool for AI coding assistants that generates specs, validates code compliance, and provides actionable feedback.
    11
    29
    MIT
  • A
    license
    Not graded
    quality
    B
    maintenance
    Provides SDLC compliance verification as tools that AI agents can invoke, continuously monitoring and evaluating development processes.
    MIT
  • A
    license
    A
    quality
    B
    maintenance
    Policy and quality engine for AI coding agents that enforces team coding standards and provides validation gates for agent-assisted software delivery.
    7
    62
    4
    MIT
  • A
    license
    Not graded
    quality
    B
    maintenance
    Enables AI agents to self-govern by scanning code for hardcoded secrets, structural violations, and AI drift in real-time, providing fix packets for automatic remediation.
    26
    MIT

View all related MCP servers

Related MCP Connectors

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/Morningstar202604/AgentSeed'

If you have feedback or need assistance with the MCP directory API, please join our Discord server