co-scientist-plugin
co-scientist Plugin
Betreiben Sie eine multi-agentische wissenschaftliche Forschungs-Engine direkt aus Ihrem Coding-Agenten.
Ein Agent-Plugins-1.0-Paket, mit dem Claude Code, Codex CLI, Cursor, VS Code, Copilot und Kiro die AI-co-scientist-Engine steuern können: Hypothesen generieren, bewerten, in einem Elo-Turnier gegeneinander antreten lassen, die Gewinner weiterentwickeln und die Synthese zurücklesen.
Installation · Was der Agent bekommt · Die Entwurfsregel · Funktioniert mit ScientistOS · Mitwirken
Die Idee
Die AI-co-scientist-Engine ist eine offene Neuimplementierung von Gottweis et al., Nature, 2026. Sie nimmt ein Forschungsziel entgegen und lässt sechs spezialisierte Agenten darüber laufen: Generierung, Reflexion, Ranking, Evolution, Nähe und Meta-Review, geplant von einem Supervisor über eine dauerhafte SQLite-Aufgabenwarteschlange.
Diese Engine hat eine CLI. Dieses Paket gibt ihr eine agentenorientierte Oberfläche, sodass das Steuerungselement Claude Code oder Codex sein kann, anstatt dass Sie Befehle eintippen:
you → "review hypothesis 3 in that Crohn's session and tell me what breaks"
agent → reads the hypothesis, searches the literature, applies the rubric,
records the review into the engine's database, reports the verdictDie Bewertung, die es geschrieben hat, ist nun eine Zeile in derselben Tabelle, in die der eigene Reflexionsagent der Engine schreibt. Sie zählt für das Turnier. Das Meta-Review wird sie sehen.
Related MCP server: consensus-mcp
Was der Agent bekommt
Ein MCP-Server mit fünfzehn Werkzeugen:
Gruppe | Werkzeuge |
Lebenszyklus |
|
Lesen |
|
Schreiben |
|
Diagnose |
|
Sieben Fähigkeiten, die das Urteilsvermögen mitbringen, das die Werkzeuge nicht haben:
Fähigkeit | Was sie tut |
| Schärft ein vages Ziel zu einem echten, prüft die Größe des Laufs, startet und überwacht ihn |
| Liest die eingestufte Ausgabe ehrlich, mit fünf bekannten Fehlermodi, die geprüft werden |
| Bewertet anhand einer Rubrik mit Bewertungsankern und einer Urteilsregel und zeichnet sie dann auf |
| Führt eine Debatte über drei bis fünf Runden, entscheidet nach geordneten Kriterien, zeichnet das Elo-Match auf |
| Kombinieren, Vereinfachen, Machbarkeit, unkonventionell, jeweils mit eigener Referenzdatei und Fehlermodus |
| Modellübergreifende Elo-Benchmark und wie man ein Ergebnis liest, ohne es zu überzeichnen |
| Prüft, ob Zitate das sagen, was sie zu sagen behaupten, pro Behauptung, mit Urteilen |
Die Entwurfsregel
Die Engine behält den gesamten Zustand: Elo, die Aufgabenwarteschlange, Deduplizierung, Einbettungen, das Token-Budget, die Beendigung. Dieses Paket implementiert nichts davon neu.
Alles, was ein Agent produziert, fließt über dieselben Repositories zurück, in die auch die eigenen Agenten
der Engine schreiben. match_record verwendet das Elo-Modul der Engine und
deren elo_journal-Idempotenz wieder. review_record schreibt dasselbe Review-Modell
und stuft draft genau wie Reflection auf reviewed hoch.
hypothesis_record leitet created_by daraus ab, ob Eltern angegeben wurden.
Die Fähigkeiten formulieren die Konsequenz in klaren Worten: Was nicht aufgezeichnet wird,
existiert nicht. Ein Agent, der eine Bewertung im Chat beschreibt, ohne review_record
aufzurufen, hat nichts produziert, was das System nutzen kann.
Das verhindert das häufige Scheitern, „die Prompts in Fähigkeiten zu portieren und es gut sein zu lassen". Die Qualität kommt nicht von den Prompts. Sie kommt vom Turnier, und ein Turnier braucht eine Anzeigetafel.
Funktioniert mit ScientistOS
Dieses Plugin generiert und bewertet Kandidatenhypothesen. Es entscheidet nicht, was Sie
daraus zu behaupten berechtigt sind, und der Unterschied ist wichtig: Eine Hypothese
kann das Turnier anführen und dennoch auf einem Mechanismus beruhen, den die Literatur
widerlegt. Die Fähigkeit reading-research-overviews listet diesen Fehlermodus und
mehrere andere auf, die von Hand zu prüfen sind.
ScientistOS macht diese Prüfung strukturell statt beratend. Es führt einen typisierten Evidenzgraph und weigert sich, eine Behauptung mit einer Stärke zu erfassen, die ihre Herkunft nicht hergibt.
this plugin → ranked hypotheses, reviews with claim / url / excerpt per source
↓
ScientistOS → hypothesis and source nodes, evidence at its honest level,
an integrity gate before anything gets written upBeide lassen sich nebeneinander installieren, da beide Pakete aus Fähigkeiten und MCP bestehen, und ein Agent mit beiden erhält den gesamten Pfad. Nichts hiervon erfordert ScientistOS, und ScientistOS hängt nicht von diesem Plugin ab.
Installation
Kein API-Schlüssel und keine Entscheidung über die Abrechnung nötig. Wenn Sie dies lesen, haben Sie bereits die Claude Code- oder Codex-CLI angemeldet, und das ist die gesamte Anforderung: Die Forschungs-Engine führt ihre Agenten über dasselbe Abonnement aus, das auch Ihr Coding-Agent nutzt.
python3.12 -m venv .venv
source .venv/bin/activate
pip install "co-scientist @ git+https://github.com/Kaimen-Inc/Co-Scientist.git"
pip install "co-scientist-plugin @ git+https://github.com/Ahmad-Jaradat-Space/co-scientist-plugin.git"
co-scientist initBei der ersten Verbindung sucht der Server nach einem funktionierenden Backend. Findet er keins,
übernimmt er die installierte und angemeldete Agenten-CLI, schreibt diese Wahl in
~/.co-scientist/config.toml und legt los. Eine vorhandene provider =-Zeile
wird nie angetastet, sodass eine selbst konfigurierte Einrichtung unangetastet bleibt. Setzen Sie
COSCI_AUTO_BACKEND=0, um das Ganze abzuschalten.
Wenn doctor weiterhin kein Backend meldet, melden Sie die CLI an (claude oder
codex login), anstatt nach einem Schlüssel zu greifen. Es wird auch einen lokalen Hash-
Embedder melden, was dem erwarteten schlüssellosen Zustand entspricht: Deduplizierung erkennt
wiederholte Formulierungen, aber nicht zwei Hypothesen, die dasselbe anders ausdrücken.
Alles bleibt auf Ihrem Rechner: SQLite unter ./data, kein Konto, kein Dienst,
für den man sich anmelden müsste, und kein Datenverkehr über die Modellaufrufe hinaus, die Ihre CLI ohnehin schon getätigt hat.
config/subscription.toml ist dieselbe Wahl,
von Hand geschrieben, mit festgelegten Modell-IDs statt der Aliasse, die Ihre CLI auflöst. Weisen Sie die Engine mit
export COSCI_CONFIG=/pfad/zu/config/subscription.toml darauf hin.
Eine nutzungsbasierte API funktioniert ebenfalls: Legen Sie vor dem ersten Lauf einen Anbieter und Schlüssel in
~/.co-scientist/config.toml fest, und die automatische Auswahl bleibt außen vor.
estimate_cost kalkuliert dann den Lauf gegen ein Budget, und die Fähigkeiten
fragen nach einer Freigabe für die Ausgaben, nicht nach der Zeit. Siehe die
Backend-Anleitung der Engine.
Codex CLI
codex plugins install ./co-scientist-pluginClaude Code
ln -s "$PWD/skills/"* ~/.claude/skills/
claude mcp add co-scientist -- co-scientist-mcpAlles andere
Jeder Client, der Agent Plugins 1.0 liest, lädt das Verzeichnis so, wie es ist. Jeder Client,
der SKILL.md und die MCP-Konfiguration separat liest, kann skills/ und mcp.json
einzeln übernehmen.
Konfiguration
Der Server liest die Konfiguration der Engine. Setzen Sie diese im env-Block Ihrer
mcp.json, falls Sie sie benötigen:
Variable | Wirkung |
| Pfad zu einer zusätzlichen TOML-Konfiguration zum Überlagern |
|
|
| Sekunden, die auf die Registrierung eines gestarteten Laufs gewartet wird, Standard 120 |
|
|
Schreibgeschützte Installationen
Eine Sitzung tätigt Hunderte von Modellaufrufen und läuft weiter, nachdem die Unterhaltung beendet ist. Auf einem gemeinsam genutzten Rechner oder überall dort, wo ein Agent keine eigene Sitzung starten können soll:
co-scientist-mcp --read-onlyLesen funktioniert weiterhin; session_start und session_resume verweigern
mit einer Erklärung.
Virtualenv-Pfade
mcp.json ruft co-scientist-mcp auf, das voraussetzt, dass das Konsolenskript im
PATH liegt. Wenn Ihr Agent die virtuelle Umgebung nicht aktiviert, verwenden Sie einen absoluten Pfad:
{
"command": "/path/to/.venv/bin/co-scientist-mcp",
"args": []
}Entwicklung
pip install -e ".[dev]"
ruff check coscientist_plugin tests
pytest -q
co-scientist-plugin-validateJeder Test läuft offline gegen eine Wegwerfdatenbank. Kein Schlüssel, kein Netzwerk, keine Modellaufrufe.
Drei Prüfungen schützen dieses Paket:
co-scientist-plugin-validateprüft die Spezifikationskonformität: die zehn erlaubten Manifestfelder, Transportarten, Fähigkeiten-Frontmatter, Übereinstimmung von Name und Verzeichnis, Textlänge und dass jeder relative Link aufgelöst wird und eine Ebene tief bleibt.tests/test_plugin.pyprüft, was ein Validator nicht kann: dass keine Fähigkeit einem Agenten befiehlt, ein MCP-Werkzeug oder einen Engine-Befehl aufzurufen, das es nicht gibt, und dass die Aufzeichnungsdisziplin in den schreibenden Fähigkeiten tatsächlich angegeben ist.tests/test_server.pydeckt die Invarianten ab, auf denen das Design beruht: Nullsummen- Elo, Idempotenz pro Runde, Verweigerung sitzungsübergreifender Aktionen, verweigerte Beweise ohne Auszug und Zustandsübergänge, die eine eingestufte Hypothese niemals zurückstufen.
Beziehung zur Engine
Dieses Repository ist nur die Plugin-Ebene. Die Engine, die es steuert, befindet sich unter
Kaimen-Inc/Co-Scientist und ist ein
eigenständiges Projekt unter derselben Lizenz. Siehe NOTICE.
Keines der Projekte ist mit Google oder den Autoren des Papiers verbunden. Hypothesen, die eines von beiden hervorbringt, sind ein Ausgangspunkt für eine Wissenschaftlerin oder einen Wissenschaftler, kein Ergebnis.
Lizenz
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- AlicenseAqualityAmaintenanceAn MCP server that lets Claude Code consult stronger AI models (o3, Gemini 2.5 Pro, DeepSeek Reasoner) when you need deeper analysis on complex problems.1102129MIT
- AlicenseNot gradedqualityCmaintenanceAn MCP server that enables multi-model debate and consensus building through a single tool. It orchestrates multiple AI models from various providers to debate topics and reach validated conclusions with real-time progress tracking.323MIT

multivon-mcpofficial
AlicenseAqualityAmaintenanceMCP server that gives AI coding agents direct access to evaluation tools.22Apache 2.0- AlicenseAqualityDmaintenanceMCP server that lets Claude Code ask GPT Codex for adversarial planning, code review, debugging, research, and risk triage without leaving your project workflow.971MIT
Related MCP Connectors
Hosted MCP server connecting claude.ai, ChatGPT and other AI apps to your own computer
MCP server for AI dialogue using various LLM models via AceDataCloud
Driflyte MCP server which lets AI assistants query topic-specific knowledge from web and GitHub.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/Ahmad-Jaradat-Space/co-scientist-plugin'
If you have feedback or need assistance with the MCP directory API, please join our Discord server