Skip to main content
Glama
cacity

ResearchBrain MCP Server

by cacity

ResearchBrain

English | 日本語

状態 プラットフォーム Python ライセンス

ResearchBrain は Windows 向けのローカルファーストな研究知識ワークベンチです。文献の発見、収集、管理、読解、解析、検索、調査、引用をカバーし、一次資料から追跡可能な研究結論に至るまでの統合ワークフローを提供します。

Zotero 内の書誌情報、コレクション、タグ、PDF をインクリメンタルにミラーリングできるほか、DOI による一括インポートや Crossref、OpenAlex、arXiv、PubMed などのソースからの文献発見、および準拠したオープンソースからの全文取得が可能です。インポートされた文献は DOI などの識別子で重複排除され、PDF は直接読むことができ、MinerU または PyMuPDF によってページ番号とセクション位置が付与された Markdown に変換されます。書誌情報、要約、全文はそれぞれベクトル化され、ローカル検索、ローカルファーストのネットワーク補完、および全ネットワーク調査に使用できます。各回答には元の証拠、ページ番号、またはオンライン出典が保持され、オンラインで見つかった文献はライブラリにインポート可能で、過去のセッションは復元でき、参考文献は CSL-JSON、BibTeX、RIS、DOI リスト、Markdown としてエクスポートでき、MCP を介して Codex などのクライアントから呼び出すこともできます。

書誌情報、PDF、解析結果、ベクトルインデックス、会話記録はデフォルトでローカルマシンに保存されます。ユーザーがオンライン発見を有効にしたり、MiniMax や DeepSeek を呼び出した場合にのみ、対応するリクエストが送信されます。アプリケーションは Windows 11 上でスタンドアロンで動作し、WSL、gbrain、Docker、PostgreSQL に依存しません。

現在は 0.1.8 alpha です。コアの研究ループは動作しますが、Zotero の完全な代替品ではありません。

ResearchBrain デスクトップインターフェース

コア機能

  • ローカル文献ライブラリ: 独立したライブラリ、または Zotero の読み取り専用ミラー。Zotero library version に基づいて書誌情報、著者、コレクション、タグ、PDF 添付ファイルをインクリメンタルに同期し、要約ベクトルと PDF 全文ベクトルの状態をそれぞれ表示します。

  • 識別とインクリメンタル判定: 正規化された DOI/PMCID/PMID/arXiv で文献を識別し、SHA-256 で PDF を識別します。書誌情報のみ、要約がインデックス済み、PDF が保存済み、PDF が解析済み、全文がインデックス済みの5つの状態を明確に区別します。

  • 文献収集: 一括 DOI、Crossref メタデータ、Crossref/OpenAlex/arXiv/PubMed オンライン発見、複数識別子による重複排除、DOI なしのレコードのインポートも可能。

  • 合法的な全文: Unpaywall、OpenAlex、PMC、およびオープンライセンス付きの Crossref リンクを介して PDF を特定し、オープンであることが確認されたランディングページから PDF を抽出します。候補が失敗した場合は自動的にフォールバックし、手動で PDF を追加することもできます。

  • PDF 解析: MinerU 優先、PyMuPDF フォールバック。Markdown、構造化 JSON、ページ番号、セクション、図表の位置を出力します。

  • ローカル検索: MiniMax embo-01 で書誌情報、要約、PDF 全文を同時にベクトル化し、LanceDB が全文、ベクトル、RRF 融合ランキングを提供します。空のライブラリでも明確な準備状態の説明を返します。

  • 証拠に基づく Q&A: 「ローカルのみ」「ローカル優先+ネットワーク」「全ネットワーク調査」をサポート。DeepSeek は提供されたローカルまたはオンラインの証拠 ID のみを引用できます。

  • 連続会話: ライブラリごとにすべてのセッション、メッセージ、引用を永続的に保存し、復元可能。現在の質問の検索重みは 1.0、最近の質問のコンテキスト検索重みは 0.25、過去のモデル回答はコンテキスト理解のみに使用され、証拠重みは常に 0 です。

  • Scholar 補完: 検索式をブラウザの Google Scholar に直接渡すことができ、不安定なページスクレイピングに依存しません。

  • 文献エクスポート: CSL-JSON、BibTeX、RIS、DOI リスト、Markdown。

  • Agent 連携: FastAPI、CLI、デスクトップアプリ、stdio MCP が同じ SQLite と LanceDB データを共有します。

Related MCP server: Paper Memory MCP Lite

設計上の制約

  • Zotero ミラーは一方向読み取り専用であり、zotero.sqlite、添付ファイル、コレクションへの書き戻しは行いません。

  • Zotero Desktop Local API は削除レコードのエンドポイントを提供しません。追加、変更、新規/置換 PDF はインクリメンタルに同期されますが、Zotero で削除されたアイテムは現在ミラーから自動削除されません。

  • 自動全文取得は Sci-Hub、LibGen、または有料壁回避サービスを統合しません。

  • PDF、書誌情報、ベクトルライブラリ、チャット記録はデフォルトでローカルに残ります。MiniMax/DeepSeek を呼び出すと、関連テキストが選択したサービスプロバイダーに送信されます。

  • 基本インストールパッケージには MinerU モデルは含まれません。MinerU が設定されていない場合は自動的に PyMuPDF を使用します。

  • 0.1.x には高度な書誌情報編集、複雑な重複アイテムのインタラクティブなマージ、PDF 注釈、チームコラボレーションは含まれません。

詳細はプライバシーとセキュリティの境界およびライセンス情報を参照してください。

アーキテクチャ

flowchart LR
  UI["Tauri + React"] --> API["FastAPI sidecar"]
  MCP["Codex / MCP client"] --> CORE["Shared services"]
  API --> CORE
  CORE --> DB["SQLite"]
  CORE --> IDX["LanceDB"]
  CORE --> OBJ["Content-addressed PDFs"]
  CORE --> ZOT["Zotero Local API"]
  CORE --> NET["Crossref / OpenAlex / arXiv / PubMed / Unpaywall"]
  CORE --> MODELS["MiniMax / DeepSeek"]

アーキテクチャの決定、プロセスモデル、データ所有権についてはアーキテクチャドキュメントを参照してください。

ソースから実行

前提条件

  • Windows 11 x64

  • Python 3.11

  • Node.js 20

  • Rust stable MSVC

  • Visual Studio C++ Build Tools、WebView2、PowerShell 7 または Windows PowerShell

  • uv のインストールを推奨

git clone git@github.com:cacity/ResearchBrain.git
cd ResearchBrain

uv venv --python 3.11
uv sync --all-extras --group dev
$env:PYTHONPATH = "src"
.\.venv\Scripts\python.exe -m researchbrain.cli init

cd desktop
npm ci
npm run tauri dev

ローカル API とブラウザフロントエンドのみを起動:

$env:PYTHONPATH = "src"
.\.venv\Scripts\python.exe -m researchbrain.cli serve
cd desktop
npm run dev

プロダクションデスクトップ版はランダムなループバックポートを選択し、256 ビットのセッショントークンを生成します。開発 API はデフォルトで 127.0.0.1:8765、Vite はデフォルトで 127.0.0.1:1420 を使用します。

初回設定

  1. 「設定」で Crossref、Unpaywall、OpenAlex、PubMed 用の連絡先メールアドレスを入力します。

  2. オプションで NCBI と OpenAlex API Key を入力すると、より安定したオンライン検索枠が得られます。

  3. Zotero データディレクトリ(例:%USERPROFILE%\Zotero)を確認し、Zotero でローカル API を有効にします。

  4. MiniMax と DeepSeek のキーを Windows Credential Manager に保存します。

  5. オプション:MinerU をインストールし、「設定 > ドキュメント解析」で mineru.exe の完全パスを入力します。

  6. 「Zotero 読み取り専用ミラー」ライブラリを作成し、「Zotero を検出」をクリックしてから初回同期を実行します。以降は「インクリメンタル同期」をクリックすると、library version の水位以降に追加または変更された書誌情報と PDF のみが処理されます。

  7. 同期統計で新規書誌情報、PDF、欠落添付ファイル、解析、ベクトル数を確認します。「タスク」ページで失敗したタスクを一括再試行できます。

デフォルトのデータディレクトリは %LOCALAPPDATA%\ResearchBrain です:

ResearchBrain/
  config/settings.json       # 不含密钥的设置
  data/library.sqlite        # 题录、任务、对话和出处
  data/lancedb/              # 可重建检索索引
  library/objects/           # SHA-256 内容寻址 PDF
  artifacts/                 # Markdown、JSON 和图表产物
  runtime/                   # 可回滚外部组件

Codex と MCP

デスクトップ版をインストールした後、「設定 > Codex」で「MCP を登録」をクリックし、新しい Codex タスクを作成すると以下を呼び出せます:

  • list_libraries

  • get_item

  • search_library

  • ask_library

  • export_references

ソース環境でも実行可能:

.\scripts\register_codex_mcp.ps1
codex.cmd mcp list

テストとビルド

.\.venv\Scripts\python.exe -m ruff format --check --no-cache src tests scripts
.\.venv\Scripts\python.exe -m ruff check --no-cache src tests scripts
.\.venv\Scripts\python.exe -m pytest -p no:cacheprovider
cd desktop
npm run typecheck
npm run format:check

Windows インストーラ:

.\scripts\build_release.ps1

完全な開発、テスト、リリースプロセスについては開発ガイド、リリースガイド、GitHub リリースチェックリストを参照してください。

リポジトリ構造

src/researchbrain/       Python 业务核心、API、CLI 和 MCP
desktop/src/             React/TypeScript 桌面界面
desktop/src-tauri/       Rust/Tauri 宿主和 sidecar 生命周期
src/researchbrain/migrations/  Alembic 数据库迁移
tests/                   Python 自动化测试
scripts/                 构建、注册、冒烟和视觉检查脚本
docs/                    架构、隐私、许可、路线图和开发文档
.github/                 CI、依赖更新和协作模板

コントリビューション

問題を提出する前に、コントリビューションガイド、サポート情報、セキュリティポリシーをお読みください。個人の PDF、Zotero データベース、API キー、ブラウザの Cookie、個人パスを含むログをアップロードしないでください。

ライセンス

このプロジェクトは GNU Affero General Public License v3.0 only の下で公開されています。PyMuPDF、MinerU、およびその他のサードパーティコンポーネントはそれぞれのライセンスを保持します。インストーラを配布する前に、サードパーティライセンス情報を必ずお読みください。

Related MCP Connectors

Related MCP Servers

  • F
    license
    C
    quality
    D
    maintenance
    Exposes a local biomedical literature pipeline as MCP tools for automated research workflows. Enables literature search, open-access paper retrieval, and draft generation for biomedical and pathology domains through standard MCP clients.
    6
    -
  • F
    license
    A
    quality
    C
    maintenance
    Enables bibliographic research on a private local Calibre library by providing read-only metadata search, book inspection, and optional RAG-based content retrieval through MCP.
    5
    -
  • A
    license
    Not graded
    quality
    A
    maintenance
    Enables a local academic research workflow via any MCP client: literature search across Scopus and OpenAlex, citation chains, per-project research memory, paper download, and PDF-to-Markdown conversion through MinerU.
    GPL 3.0