co-scientist-plugin
co-scientist plugin
Ejecuta un motor de investigación científica multiagente desde dentro de tu agente de codificación.
Un paquete Agent Plugins 1.0 que permite que Claude Code, Codex CLI, Cursor, VS Code, Copilot y Kiro manejen el motor AI co-scientist: generar hipótesis, revisarlas, resolverlas en un torneo Elo, evolucionar las ganadoras y leer la síntesis.
Instalación · Lo que obtiene el agente · La regla del diseño · Funciona con ScientistOS · Contribuir
La idea
El motor AI co-scientist es una reimplementación abierta de Gottweis et al., Nature, 2026. Toma un objetivo de investigación y ejecuta sobre él seis agentes especializados: Generation, Reflection, Ranking, Evolution, Proximity y Meta-review, orquestados por un Supervisor sobre una cola de tareas SQLite duradera.
Ese motor tiene una CLI. Este paquete le ofrece una superficie orientada a agentes, de modo que lo que lo impulse sea Claude Code o Codex en lugar de que tú escribas comandos:
you → "review hypothesis 3 in that Crohn's session and tell me what breaks"
agent → reads the hypothesis, searches the literature, applies the rubric,
records the review into the engine's database, reports the verdictLa revisión que escribió ahora es una fila en la misma tabla donde escribe el propio agente Reflection del motor. Cuenta para el torneo. La meta-revisión la verá.
Related MCP server: consensus-mcp
Lo que obtiene el agente
Un servidor MCP con quince herramientas:
Grupo | Herramientas |
Ciclo de vida |
|
Lectura |
|
Escritura |
|
Diagnóstico |
|
Siete habilidades que aportan el criterio que las herramientas no pueden aportar:
Habilidad | Qué hace |
| Convierte un objetivo vago en uno real, acota el tamaño de la ejecución, la inicia y la supervisa |
| Lee el resultado ordenado con honestidad, verificando cinco modos de fallo conocidos |
| Revisa con una rúbrica que tiene anclas de puntuación y una regla de decisión del veredicto; después lo registra |
| Dirige un debate de tres a cinco turnos, decide según criterios ordenados y registra la partida de Elo |
| Combinar, simplificar, viabilidad, originalidad: cada modo con su propio archivo de referencia y su modo de fallo |
| Banco de pruebas Elo entre modelos, y cómo leer un resultado sin sobreafirmación |
| Comprueba que las citas dicen lo que se afirma que dicen, afirmación por afirmación, con veredictos |
La regla del diseño
El motor conserva todo el estado: Elo, la cola de tareas, la deduplicación, los embeddings, el presupuesto de tokens, la terminación. Este paquete no reimplementa nada de eso.
Todo lo que un agente produce vuelve a ingresar por los mismos repositorios en los que escriben los agentes del propio motor. match_record reutiliza el módulo Elo del motor y la idempotencia de su elo_journal. review_record escribe el mismo modelo Review y promueve el estado de draft a reviewed exactamente como Reflection. hypothesis_record obtiene created_by a partir de si se aportaron objetivos intermedios.
Las habilidades expresan la consecuencia en palabras claras: lo que no se registra no existe. Un agente que describe una revisión en el chat sin llamar a review_record no ha producido nada que el sistema pueda usar.
Esto es lo que evita la falla habitual de "convertir los mismos mensajes com un ills and call it done". No es de ahí de donde sale la calidad: es del torneo, y un torneo necesita algún sitio donde llevar la cuenta.
Funciona con ScientistOS
Este plugin genera y clasifica hipótesis candidatas. No decide qué se puede afirmar a partir de ellas, y la diferencia importa: una hipótesis puede encabezar el torneo y aun así apoyarse en un mecanismo que la literatura contradice. La habilidad reading-research-overviews lista ese modo de fallo y otros más para comprobar a mano.
ScientistOS convierte esa comprobación en estructural, no solo recomendación. Mantiene un grafo de evidencia tipado y se niega a registrar una afirmación con una fuerza que su linaje no respalda.
this plugin → ranked hypotheses, reviews with claim / url / excerpt per source
↓
ScientistOS → hypothesis and source nodes, evidence at its honest level,
an integrity gate before anything gets written upAmbos se instalan lado a lado, ya que ambos son paquetes de habilidades y MCP, y un agente con ambos cargados obtiene el camino completo. Nada aquí exige ScientistOS, y ScientistOS no depende de esto.
Instalación
Sin clave de API, y nada que decidir sobre la facturación. Si estás leyendo esto, ya tienes iniciada la sesión de Claude Code o Codex CLI, y ese es el único requisito: el motor de investigación ejecuta sus agentes a través de la misma suscripción que usa tu agente de codificación.
python3.12 -m venv .venv
source .venv/bin/activate
pip install "co-scientist @ git+https://github.com/Kaimen-Inc/Co-Scientist.git"
pip install "co-scientist-plugin @ git+https://github.com/Ahmad-Jaradat-Space/co-scientist-plugin.git"
co-scientist initEn la primera conexión, el servidor busca un backend disponible. Si no encuentra ninguno, adopta la CLI de agente que esté instalada y con sesión iniciada, escribe esa elección en ~/.co-scientist/config.toml y sigue adelante. Una línea provider = existente nunca se toca; una configuración que hayas hecho a mano se respeta. Establece COSCI_AUTO_BACKEND=0 para desactivar por completo ese proceso.
Si doctor sigue reportando que no hay backend, inicia sesión en la CLI (claude, o codex login) en lugar de buscar una clave. También reportaráo un embedding hash local, que es el estado esperado sin clave: la deduplicación detecta formulaciones repetidas, pero no dos hipótesis que lo mismo con otras palabras.
Todo queda en tu máquina: SQLite en ./data, sin cuenta, sin servicio que activar y sin tráfico más allá de las llamadas de modelo que tu CLI ya realizaba.
config/subscription.toml es esa misma elección escrito a mano, con los IDs de modelo fijados en lugar de dejarlos al alias que resuelve tu CLI. Apunta el motor hacia él con export COSCI_CONFIG=/path/to/config/subscription.toml.
Una API puntual también funciona: configura el proveedor y la clave en ~/.co-scientist/config.toml antes del primer arranque, y la selección automática no se intercede. Después estimate_cost calculará el precio de la ejecución contra un presupuesto, y las habilidades pedirán un visto bueno por el gasto más que por el tiempo. Consulta la guía de backend del motor.
Codex CLI
codex plugins install ./co-scientist-pluginClaude Code
ln -s "$PWD/skills/"* ~/.claude/skills/
claude mcp add co-scientist -- co-scientist-mcpCualquier otro caso
Cualquier cliente que lea Agent Plugins 1.0 carga el directorio tal cual es. Cualquier cliente que lea SKILL.md y la configuración de MCP por separado puede tomar skills/ y mcp.json por su cuenta.
Configuración
El servidor lee la configuración del motor. Define lo siguiente en el bloque env de tu mcp.json si lo necesitas:
Variable | Efecto |
| Ruta a un TOML de configuración adicional que superponer |
|
|
| Segundos de espera para que una ejecución lanzada se registre, por defecto 120 |
|
|
Instalaciones de solo lectura
Una sesión requiere decenas de llamadas de modelo y sigue ejecutándose después de que la conversación termina. En una máquina compartida, o allí donde no queramosQue un agente pueda iniciar una por sí mismo:
co-scientist-mcp --read-onlyLas lecturas siguen funcionando; session_start y session_resume se rechazan con una explicación.
Rutas de virtualenv
mcp.json llama a co-scientist-mcp, que asume que el script de la consola está en el PATH. Si tu agente no activa el virtualenv, usará una ruta absoluta:
{
"command": "/path/to/.venv/bin/co-scientist-mcp",
"args": []
}Desarrollo
pip install -e ".[dev]"
ruff check coscientist_plugin tests
pytest -q
co-scientist-plugin-validateCada prueba se ejecuta sin conexión contra crean bases de datos desechables. Sin clave, sin red, sin llamadas de modelo.
Tres comprobaciones protegen este paquete:
co-scientist-plugin-validatecomprueba la conformidad con la especificación: los diez campos de manifiesto permitidos, tipos de transporte, front‑matter de las habilidades, coincidencia entre nombre y directorio, longitud del cuerpo, y que todo enlace relativo se resuelve y se mantiene a un nivel de profundidad.tests/test_plugin.pycomprueba lo que un validador no puede: que ninguna habilidad ordene al agente llamar a una herramienta MCP o a un comando del motor que no exista, y que la disciplina de registro esté realmente declarada en las habilidades que escriben.tests/test_server.pycubre las invariantes sobre las contemporáneas: Elo de suma cero, idempotencia por ronda, rechazo entre sesiones, evidencia sin extracto rechazada y transiciones de estado que nunca arrastran hipótesis clasificadas hacia atrás.
Relación con el motor
Este repositorio es sólo la capa de plugin. El motor que conduce vive en Kaimen-Inc/Co-Scientist y ya es un proyecto separado bajo la misma licencia. Véase NOTICE.
Ninguno de los dos proyectos está afiliado a Google ni a los autores del artículo. Las hipótesis que produce uno u otro son un punto de partida para un científico, no un hallazgo.
Licencia
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- AlicenseAqualityAmaintenanceAn MCP server that lets Claude Code consult stronger AI models (o3, Gemini 2.5 Pro, DeepSeek Reasoner) when you need deeper analysis on complex problems.1102129MIT
- AlicenseNot gradedqualityCmaintenanceAn MCP server that enables multi-model debate and consensus building through a single tool. It orchestrates multiple AI models from various providers to debate topics and reach validated conclusions with real-time progress tracking.323MIT

multivon-mcpofficial
AlicenseAqualityAmaintenanceMCP server that gives AI coding agents direct access to evaluation tools.22Apache 2.0- AlicenseAqualityDmaintenanceMCP server that lets Claude Code ask GPT Codex for adversarial planning, code review, debugging, research, and risk triage without leaving your project workflow.971MIT
Related MCP Connectors
Hosted MCP server connecting claude.ai, ChatGPT and other AI apps to your own computer
MCP server for AI dialogue using various LLM models via AceDataCloud
Driflyte MCP server which lets AI assistants query topic-specific knowledge from web and GitHub.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/Ahmad-Jaradat-Space/co-scientist-plugin'
If you have feedback or need assistance with the MCP directory API, please join our Discord server