Skip to main content
Glama
cacity

ResearchBrain MCP Server

by cacity

ResearchBrain

English | 简体中文

Status Platform Python License

ResearchBrain ist eine lokal priorisierte wissenschaftliche Wissenswerkbank für Windows, die rund um die Erkennung, Sammlung, Verwaltung, Lektüre, Analyse, Recherche, Untersuchung und Zitation von Publikationen einen integrierten Workflow von Primärquellen bis hin zu nachvollziehbaren Forschungsergebnissen bietet.

Es kann sowohl inkrementell die Zotero-Einträge, Sammlungen, Tags und PDFs spiegeln als auch per DOI-Batch-Import sowie über Quellen wie Crossref, OpenAlex, arXiv und PubMed Publikationen erkennen und aus kompatiblen offenen Quellen Volltexte beziehen. Importierte Publikationen werden anhand von DOIs und anderen Identifikatoren dedupliziert, PDFs können direkt gelesen und von MinerU oder PyMuPDF in Markdown mit Seiten- und Kapitelverweisen umgewandelt werden; Titel, Abstracts und Volltexte werden jeweils vektorisiert, was die lokale Suche, die lokal priorisierte Online-Ergänzung und die umfassende Web-Recherche ermöglicht. Jede Antwort enthält die Originalbelege, Seitenzahlen oder Online-Quellenangaben; im Web entdeckte Publikationen können weiter in die Bibliothek importiert werden; historische Sitzungen sind wiederherstellbar; Referenzen können als CSL-JSON, BibTeX, RIS, DOI-Liste oder Markdown exportiert werden, auch über MCP an Clients wie Codex übergeben.

Titel, PDFs, Analyseergebnisse, Vektorindizes und Gesprächsaufzeichnungen werden standardmäßig lokal gespeichert; nur wenn der Benutzer die Online-Erkennung aktiviert oder MiniMax/DeepSeek aufruft, werden entsprechende Anfragen gesendet. Die Anwendung läuft unabhängig auf Windows 11 und benötigt weder WSL, gbrain, Docker noch PostgreSQL.

Derzeit 0.1.8 alpha. Der zentrale Forschungszyklus ist funktionsfähig, aber noch kein vollständiger Ersatz für Zotero.

ResearchBrain Desktop-Oberfläche

Kernfunktionen

  • Lokale Literaturbibliothek: Eigenständige Bibliothek oder schreibgeschützter Zotero-Spiegel; inkrementelle Synchronisation von Titeln, Autoren, Sammlungen, Tags und PDF-Anhängen basierend auf der Zotero Library Version mit getrennter Statusanzeige für Abstract-Vektoren und PDF-Volltextvektoren.

  • Identität & Inkrementelle Bestimmung: Kennzeichnung von Publikationen durch normalisierte DOI/PMCID/PMID/arXiv, PDFs durch SHA-256; klare Unterscheidung von fünf Statusstufen: Nur Titel, Abstract indiziert, PDF gespeichert, PDF analysiert und Volltext indiziert.

  • Literaturerfassung: Batch-DOI, Crossref-Metadaten, Online-Erkennung über Crossref/OpenAlex/arXiv/PubMed, Deduplizierung mittels mehrerer Identifikatoren, auch Import von Einträgen ohne DOI.

  • Legale Volltexte: PDF-Lokalisierung über Unpaywall, OpenAlex, PMC und Crossref-Links mit offenen Lizenzen; PDF-Extraktion auch von als offen bestätigten Landing Pages; automatischer Fallback bei Fehlschlag der Kandidaten; manuelles Hinzufügen von PDFs möglich.

  • PDF-Analyse: MinerU vorrangig, PyMuPDF als Fallback; Ausgabe von Markdown, strukturiertem JSON, Seitenzahlen, Kapitel- und Abbildungspositionen.

  • Lokale Suche: Gleichzeitige Vektorisierung von Titeln, Abstracts und PDF-Volltexten mit MiniMax embo-01; LanceDB bietet Volltext-, Vektor- und RRF-Fusion-Sortierung; leere Bibliothek gibt klaren Status zur Bereitschaft aus.

  • Evidenzbasierte Beantwortung: Unterstützt „Nur lokal“, „Lokal priorisiert + Online“, „Umfassende Web-Recherche“; DeepSeek darf nur auf bereitgestellte lokale oder Online-Beleg-IDs verweisen.

  • Fortlaufende Dialoge: Speichert alle Sitzungen, Nachrichten und Zitate dauerhaft bibliotheksbezogen und abrufbar; das aktuelle Problem hat ein Retrieval-Gewicht von 1.0, der Kontext aktueller Probleme ein Gewicht von 0.25, historische Modellantworten dienen nur dem Kontextverständnis, Belege haben stets das Gewicht 0.

  • Scholar-Ergänzung: Suchanfragen direkt an Google Scholar im Browser übergeben, um instabiles Web Scraping zu vermeiden.

  • Literaturexport: CSL-JSON, BibTeX, RIS, DOI-Liste und Markdown.

  • Agent-Anbindung: FastAPI, CLI, Desktop-Anwendung und stdio MCP teilen sich dieselben SQLite- und LanceDB-Daten.

Related MCP server: surveyHelper

Designgrenzen

  • Der Zotero-Spiegel ist unidirektional schreibgeschützt; es erfolgt kein Rückschreiben auf zotero.sqlite, Anhänge oder Sammlungen.

  • Zotero Desktop Local API bietet keinen Endpunkt zum Löschen von Einträgen; neue, geänderte und neu/ersetzte PDFs werden inkrementell synchronisiert, gelöschte Einträge in Zotero werden derzeit nicht automatisch aus dem Spiegel entfernt.

  • Der automatische Volltextbezug integriert weder Sci-Hub, LibGen noch andere Paywall-Umgehungsdienste.

  • PDFs, Titel, Vektorbibliotheken und Chatverläufe verbleiben standardmäßig lokal; die Nutzung von MiniMax/DeepSeek sendet den relevanten Text an den jeweiligen Dienstanbieter.

  • Das Basisinstallationspaket enthält keine MinerU-Modelle. Ohne MinerU-Konfiguration wird automatisch PyMuPDF verwendet.

  • 0.1.x enthält keine erweiterte Titelbearbeitung, komplexe interaktive Duplikatzusammenführung, PDF-Anmerkungen oder Teamkollaboration.

Siehe Privatsphäre- und Sicherheitsgrenzen und Lizenzhinweise.

Architektur

flowchart LR
  UI["Tauri + React"] --> API["FastAPI sidecar"]
  MCP["Codex / MCP client"] --> CORE["Shared services"]
  API --> CORE
  CORE --> DB["SQLite"]
  CORE --> IDX["LanceDB"]
  CORE --> OBJ["Content-addressed PDFs"]
  CORE --> ZOT["Zotero Local API"]
  CORE --> NET["Crossref / OpenAlex / arXiv / PubMed / Unpaywall"]
  CORE --> MODELS["MiniMax / DeepSeek"]

Architekturentscheidungen, Prozessmodell und Datenbesitz siehe Architekturdokument.

Von der Quelle ausführen

Voraussetzungen

  • Windows 11 x64

  • Python 3.11

  • Node.js 20

  • Rust stable MSVC

  • Visual Studio C++ Build Tools, WebView2 und PowerShell 7 oder Windows PowerShell

  • uv empfohlen

git clone git@github.com:cacity/ResearchBrain.git
cd ResearchBrain

uv venv --python 3.11
uv sync --all-extras --group dev
$env:PYTHONPATH = "src"
.\.venv\Scripts\python.exe -m researchbrain.cli init

cd desktop
npm ci
npm run tauri dev

Nur die lokale API und das Browser-Frontend starten:

$env:PYTHONPATH = "src"
.\.venv\Scripts\python.exe -m researchbrain.cli serve
cd desktop
npm run dev

Die Desktop-Produktionsversion wählt zufällige Loopback-Ports und generiert 256-Bit-Sitzungstoken; die Entwicklungs-API verwendet standardmäßig 127.0.0.1:8765, Vite standardmäßig 127.0.0.1:1420.

Ersteinrichtung

  1. In den „Einstellungen“ die Kontakt-E-Mail für Crossref, Unpaywall, OpenAlex und PubMed angeben.

  2. Optional NCBI- und OpenAlex-API-Key eintragen, um stabilere Online-Recherchekontingente zu erhalten.

  3. Zotero-Datenverzeichnis bestätigen, z. B. %USERPROFILE%\Zotero, und die lokale API in Zotero aktivieren.

  4. MiniMax- und DeepSeek-Schlüssel im Windows Credential Manager speichern.

  5. Optional: MinerU installieren, in „Einstellungen > Dokumentenanalyse“ den vollständigen Pfad zu mineru.exe angeben.

  6. Bibliothek vom Typ „Zotero schreibgeschützter Spiegel“ erstellen, auf „Zotero erkennen“ klicken, dann die erste Synchronisation durchführen; später mit „Inkrementelle Synchronisation“ nur neue oder geänderte Titel und PDFs ab dem letzten Library-Version-Wasserstand verarbeiten.

  7. In der Synchronisationsstatistik Anzahl neuer Titel, PDFs, fehlender Anhänge, Analysen und Vektorisierungen einsehen; auf der Seite „Aufgaben“ können fehlgeschlagene Aufgaben nachträglich wiederholt werden.

Das Standard-Datenverzeichnis ist %LOCALAPPDATA%\ResearchBrain:

ResearchBrain/
  config/settings.json       # 不含密钥的设置
  data/library.sqlite        # 题录、任务、对话和出处
  data/lancedb/              # 可重建检索索引
  library/objects/           # SHA-256 内容寻址 PDF
  artifacts/                 # Markdown、JSON 和图表产物
  runtime/                   # 可回滚外部组件

Codex und MCP

Nach der Desktop-Installation unter „Einstellungen > Codex“ auf „MCP registrieren“ klicken, dann in einer neuen Codex-Aufgabe aufrufen:

  • list_libraries

  • get_item

  • search_library

  • ask_library

  • export_references

Im Quellcode-Umgebung auch ausführbar:

.\scripts\register_codex_mcp.ps1
codex.cmd mcp list

Tests und Build

.\.venv\Scripts\python.exe -m ruff format --check --no-cache src tests scripts
.\.venv\Scripts\python.exe -m ruff check --no-cache src tests scripts
.\.venv\Scripts\python.exe -m pytest -p no:cacheprovider
cd desktop
npm run typecheck
npm run format:check

Windows-Installationspaket:

.\scripts\build_release.ps1

Der vollständige Entwicklungs-, Test- und Veröffentlichungsprozess findet sich im Entwicklungshandbuch, Veröffentlichungshandbuch und der GitHub-Veröffentlichungs-Checkliste.

Repository-Struktur

src/researchbrain/       Python 业务核心、API、CLI 和 MCP
desktop/src/             React/TypeScript 桌面界面
desktop/src-tauri/       Rust/Tauri 宿主和 sidecar 生命周期
src/researchbrain/migrations/  Alembic 数据库迁移
tests/                   Python 自动化测试
scripts/                 构建、注册、冒烟和视觉检查脚本
docs/                    架构、隐私、许可、路线图和开发文档
.github/                 CI、依赖更新和协作模板

Mitwirken

Bitte vor dem Einreichen eines Issues den Beitragsleitfaden, die Support-Anleitung und die Sicherheitsrichtlinie lesen. Keine privaten PDFs, Zotero-Datenbanken, API-Schlüssel, Browser-Cookies oder Logs mit persönlichen Pfaden hochladen.

Lizenz

Das Projekt wird unter der GNU Affero General Public License v3.0 only veröffentlicht. PyMuPDF, MinerU und andere Drittanbieter-Komponenten unterliegen ihren jeweiligen Lizenzen; vor der Verteilung eines Installationspakets muss der Drittanbieter-Lizenzhinweis gelesen werden.

A
license - permissive license
-
quality - not tested
B
maintenance

Maintenance

Maintainers
Response time
Release cycle
1Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • F
    license
    C
    quality
    D
    maintenance
    Exposes a local biomedical literature pipeline as MCP tools for automated research workflows. Enables literature search, open-access paper retrieval, and draft generation for biomedical and pathology domains through standard MCP clients.
    6
  • A
    license
    -
    quality
    A
    maintenance
    A local-first MCP server that analyzes research papers, maps citation graphs, and surfaces insights with verbatim-verified contradictions, all while keeping data private on your machine.
    1
    MIT
  • F
    license
    -
    quality
    B
    maintenance
    A local academic research assistant that indexes PDFs into a searchable vector library and exposes MCP tools for semantic search, claim extraction, contradiction detection, and multi-step research synthesis.

View all related MCP servers

Related MCP Connectors

  • Auditable MCP server for PubMed, Europe PMC, ClinicalTrials.gov, and bioRxiv/medRxiv queries

  • Agentic search over your Dewey document collections from any MCP-compatible client.

  • PubMed MCP — wraps the NCBI E-utilities API (biomedical literature, free, no auth)

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/cacity/ResearchBrain'

If you have feedback or need assistance with the MCP directory API, please join our Discord server