Skip to main content
Glama
cacity

ResearchBrain MCP Server

by cacity

ResearchBrain

English | 简体中文

Estado Plataforma Python Licencia

ResearchBrain es un puesto de trabajo de conocimiento científico local primero para Windows, centrado en el descubrimiento, recopilación, gestión, lectura, análisis, búsqueda, investigación y citación de documentos, proporcionando un flujo de trabajo integrado desde materiales originales hasta conclusiones de investigación trazables.

Puede reflejar de forma incremental las referencias bibliográficas, colecciones, etiquetas y PDF de Zotero, así como importar en lote mediante DOI y descubrir documentos a través de fuentes como Crossref, OpenAlex, arXiv, PubMed, y obtener el texto completo de fuentes abiertas legales. Los documentos importados se deduplican por identificadores como DOI, los PDF se pueden leer directamente y se convierten a Markdown con números de página y localización de secciones mediante MinerU o PyMuPDF; las referencias, resúmenes y textos completos se vectorizan por separado para búsqueda local, complemento en línea local primero e investigación en toda la red. Cada respuesta conserva la evidencia original, el número de página o la fuente en línea, los documentos encontrados en línea se pueden seguir importando a la biblioteca, las sesiones históricas se pueden restaurar y las referencias se pueden exportar como CSL-JSON, BibTeX, RIS, lista de DOI o Markdown, y también se pueden invocar a través de MCP para clientes como Codex.

Las referencias, PDF, productos de análisis, índices vectoriales y registros de conversación se guardan localmente de forma predeterminada; solo cuando el usuario habilita el descubrimiento en línea o invoca MiniMax, DeepSeek se envían las solicitudes correspondientes. La aplicación se puede ejecutar de forma independiente en Windows 11, sin depender de WSL, gbrain, Docker o PostgreSQL.

Actualmente es 0.1.8 alpha. El ciclo de investigación central se puede ejecutar, pero aún no es un reemplazo completo de Zotero.

Interfaz de escritorio de ResearchBrain

Capacidades principales

  • Biblioteca local de documentos: biblioteca independiente o espejo de solo lectura de Zotero; sincronización incremental de referencias, autores, colecciones, etiquetas y archivos PDF adjuntos según la versión de la biblioteca de Zotero, y muestra el estado de vectorización del resumen y del texto completo del PDF por separado.

  • Identidad y determinación incremental: identifica documentos mediante DOI/PMCID/PMID/arXiv normalizados, y PDF mediante SHA-256; distingue claramente cinco estados: solo referencias, resumen indexado, PDF guardado, PDF analizado y texto completo indexado.

  • Recopilación de documentos: DOI en lote, metadatos de Crossref, descubrimiento en línea de Crossref/OpenAlex/arXiv/PubMed, deduplicación por múltiples identificadores, también se pueden importar registros sin DOI.

  • Texto completo legal: localiza PDF a través de Unpaywall, OpenAlex, PMC y enlaces de Crossref con licencia abierta, también extrae PDF de páginas de aterrizaje confirmadas como abiertas; retrocede automáticamente cuando fallan los candidatos, y admite la adición manual de PDF.

  • Análisis de PDF: MinerU prioritario, PyMuPDF como respaldo, genera Markdown, JSON estructurado, números de página, secciones y ubicaciones de figuras.

  • Búsqueda local: MiniMax embo-01 vectoriza simultáneamente referencias, resúmenes y texto completo de PDF, LanceDB proporciona clasificación de fusión de texto completo, vectorial y RRF; las bibliotecas vacías también devuelven una descripción clara del estado de preparación.

  • Preguntas y respuestas con evidencia: admite "solo local", "local primero + en línea" e "investigación en toda la red"; DeepSeek solo puede citar las identificaciones de evidencia local o en línea proporcionadas.

  • Conversación continua: guarda permanentemente todas las sesiones, mensajes y citas por biblioteca y se pueden restaurar; el peso de búsqueda de la pregunta actual es 1.0, el peso de búsqueda de contexto de las preguntas recientes es 0.25, las respuestas del modelo histórico solo se usan para comprender el contexto, el peso de la evidencia siempre es 0.

  • Complemento de Scholar: puede enviar la consulta de búsqueda directamente a Google Scholar en el navegador, evitando la dependencia de la extracción inestable de páginas.

  • Exportación de documentos: CSL-JSON, BibTeX, RIS, lista de DOI y Markdown.

  • Integración de agente: FastAPI, CLI, aplicación de escritorio y stdio MCP comparten la misma base de datos SQLite y LanceDB.

Related MCP server: surveyHelper

Límites de diseño

  • El espejo de Zotero es unidireccional de solo lectura, no escribe de vuelta a zotero.sqlite, archivos adjuntos o colecciones.

  • La API local de Zotero Desktop no proporciona un punto final para eliminar registros; las adiciones, modificaciones y adiciones/reemplazos de PDF se sincronizan de forma incremental, los elementos eliminados en Zotero actualmente no se eliminan automáticamente del espejo.

  • La obtención automática de texto completo no integra Sci-Hub, LibGen ni ningún servicio de elusión de muros de pago.

  • Los PDF, referencias, bibliotecas vectoriales y registros de chat permanecen localmente de forma predeterminada; al invocar MiniMax/DeepSeek, el texto relevante se envía al proveedor de servicios seleccionado.

  • El paquete de instalación básico no incluye el modelo MinerU. Cuando no se configura MinerU, se usa PyMuPDF automáticamente.

  • 0.1.x no incluye edición avanzada de referencias, fusión interactiva de duplicados complejos, anotaciones de PDF o colaboración en equipo.

Consulte Límites de privacidad y seguridad y Notas de licencia.

Arquitectura

flowchart LR
  UI["Tauri + React"] --> API["FastAPI sidecar"]
  MCP["Codex / MCP client"] --> CORE["Shared services"]
  API --> CORE
  CORE --> DB["SQLite"]
  CORE --> IDX["LanceDB"]
  CORE --> OBJ["Content-addressed PDFs"]
  CORE --> ZOT["Zotero Local API"]
  CORE --> NET["Crossref / OpenAlex / arXiv / PubMed / Unpaywall"]
  CORE --> MODELS["MiniMax / DeepSeek"]

Las decisiones de arquitectura, el modelo de procesos y la propiedad de los datos se encuentran en el documento de arquitectura.

Ejecutar desde el código fuente

Requisitos previos

  • Windows 11 x64

  • Python 3.11

  • Node.js 20

  • Rust stable MSVC

  • Visual Studio C++ Build Tools, WebView2 y PowerShell 7 o Windows PowerShell

  • Se recomienda instalar uv

git clone git@github.com:cacity/ResearchBrain.git
cd ResearchBrain

uv venv --python 3.11
uv sync --all-extras --group dev
$env:PYTHONPATH = "src"
.\.venv\Scripts\python.exe -m researchbrain.cli init

cd desktop
npm ci
npm run tauri dev

Para iniciar solo la API local y el frontend del navegador:

$env:PYTHONPATH = "src"
.\.venv\Scripts\python.exe -m researchbrain.cli serve
cd desktop
npm run dev

La versión de escritorio de producción selecciona un puerto loopback aleatorio y genera un token de sesión de 256 bits; la API de desarrollo usa 127.0.0.1:8765 de forma predeterminada, Vite usa 127.0.0.1:1420 de forma predeterminada.

Configuración inicial

  1. En "Configuración", complete el correo electrónico de contacto para Crossref, Unpaywall, OpenAlex y PubMed.

  2. Opcionalmente, complete la clave API de NCBI y OpenAlex para obtener cuotas de búsqueda en línea más estables.

  3. Confirme el directorio de datos de Zotero, por ejemplo %USERPROFILE%\Zotero, y habilite la API local en Zotero.

  4. Guarde las claves de MiniMax y DeepSeek en el Administrador de credenciales de Windows.

  5. Opcional: instale MinerU, complete la ruta completa de mineru.exe en "Configuración > Análisis de documentos".

  6. Cree una biblioteca "Espejo de solo lectura de Zotero", haga clic en "Detectar Zotero", luego realice la primera sincronización; posteriormente, haga clic en "Sincronización incremental" para procesar solo las referencias y PDF agregados o modificados después del nivel de versión de la biblioteca.

  7. En las estadísticas de sincronización, vea la cantidad de nuevas referencias, PDF, archivos adjuntos faltantes, análisis y vectores; la página "Tareas" permite reintentar tareas fallidas en lote.

El directorio de datos predeterminado es %LOCALAPPDATA%\ResearchBrain:

ResearchBrain/
  config/settings.json       # 不含密钥的设置
  data/library.sqlite        # 题录、任务、对话和出处
  data/lancedb/              # 可重建检索索引
  library/objects/           # SHA-256 内容寻址 PDF
  artifacts/                 # Markdown、JSON 和图表产物
  runtime/                   # 可回滚外部组件

Codex y MCP

Después de instalar la versión de escritorio, en "Configuración > Codex" haga clic en "Registrar MCP", cree una nueva tarea de Codex para invocar:

  • list_libraries

  • get_item

  • search_library

  • ask_library

  • export_references

El entorno de código fuente también se puede ejecutar:

.\scripts\register_codex_mcp.ps1
codex.cmd mcp list

Pruebas y compilación

.\.venv\Scripts\python.exe -m ruff format --check --no-cache src tests scripts
.\.venv\Scripts\python.exe -m ruff check --no-cache src tests scripts
.\.venv\Scripts\python.exe -m pytest -p no:cacheprovider
cd desktop
npm run typecheck
npm run format:check

Paquete de instalación de Windows:

.\scripts\build_release.ps1

Consulte la Guía de desarrollo, la Guía de publicación y la Lista de verificación de publicación en GitHub para conocer el flujo completo de desarrollo, pruebas y publicación.

Estructura del repositorio

src/researchbrain/       Python 业务核心、API、CLI 和 MCP
desktop/src/             React/TypeScript 桌面界面
desktop/src-tauri/       Rust/Tauri 宿主和 sidecar 生命周期
src/researchbrain/migrations/  Alembic 数据库迁移
tests/                   Python 自动化测试
scripts/                 构建、注册、冒烟和视觉检查脚本
docs/                    架构、隐私、许可、路线图和开发文档
.github/                 CI、依赖更新和协作模板

Contribuir

Antes de enviar un problema, lea primero la Guía de contribución, las Notas de soporte y la Política de seguridad. No cargue PDF personales, bases de datos de Zotero, claves API, cookies del navegador o registros que contengan rutas personales.

Licencia

El proyecto se publica bajo GNU Affero General Public License v3.0 only. PyMuPDF, MinerU y otros componentes de terceros conservan sus respectivas licencias; antes de distribuir el paquete de instalación, debe leer las Notas de licencia de terceros.

A
license - permissive license
-
quality - not tested
B
maintenance

Maintenance

Maintainers
Response time
Release cycle
1Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • F
    license
    C
    quality
    D
    maintenance
    Exposes a local biomedical literature pipeline as MCP tools for automated research workflows. Enables literature search, open-access paper retrieval, and draft generation for biomedical and pathology domains through standard MCP clients.
    6
  • A
    license
    -
    quality
    A
    maintenance
    A local-first MCP server that analyzes research papers, maps citation graphs, and surfaces insights with verbatim-verified contradictions, all while keeping data private on your machine.
    1
    MIT
  • F
    license
    -
    quality
    B
    maintenance
    A local academic research assistant that indexes PDFs into a searchable vector library and exposes MCP tools for semantic search, claim extraction, contradiction detection, and multi-step research synthesis.

View all related MCP servers

Related MCP Connectors

  • Auditable MCP server for PubMed, Europe PMC, ClinicalTrials.gov, and bioRxiv/medRxiv queries

  • Agentic search over your Dewey document collections from any MCP-compatible client.

  • PubMed MCP — wraps the NCBI E-utilities API (biomedical literature, free, no auth)

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/cacity/ResearchBrain'

If you have feedback or need assistance with the MCP directory API, please join our Discord server