scholar-mcp
little-librarian
Ein lokaler MCP-Server, der .epub-Dateien indiziert und semantische Suchwerkzeuge bereitstellt, die auf pplx-embed-context-v1 (Late Chunking) und Qdrant basieren.
MCP client (Claude Desktop, Claude Code, …)
│
▼ tool calls via MCP
server.py
pplx-embed-context-v1-0.6b + Qdrant (local)Dateien
Datei | Rolle |
| MCP-Server — EPUB-Ingestion, Embedding, Suche, Qdrant-Speicherung |
| Separater MCP-Server für Code (AST-basiertes Chunking) |
Related MCP server: ragi
Warum pplx-embed-context-v1
Verwendet Late Chunking: Alle Chunks eines Kapitels durchlaufen einen einzigen Forward-Pass, sodass jedes Chunk-Embedding den vollständigen Dokumentkontext erfasst, ohne dass zur Inferenzzeit ein Dokument-Präfix erforderlich ist. Erreicht 81,96 nDCG@10 auf ConTEB.
Schnellstart
# 1. install
pip install -e .
# 2. ingest your library (runs embedding, then exits)
HF_HUB_OFFLINE=0 python server.py --index ./library
# 3. start the MCP server
python server.py
# optional: preload the model at startup
python server.py --preloadMCP-Werkzeuge
Werkzeug | Beschreibung |
| Semantische Suche, gibt die Top-k-Textstellen mit Scores zurück |
| Suche gruppiert nach |
| Ruft den vollständigen Text für ein Buch/Kapitel ab |
| Listet alle indizierten Bücher mit Kapitelanzahl auf |
| Qdrant-Sammlungsinformationen (Anzahl der Punkte, Vektorgröße) |
| Vollständige Inhaltsübersicht: Bücher, Kapitel, Chunks pro Buch, durchschnittliche Chunk-Länge |
| Zeigt an, welches Gerät (CPU/GPU) für Embeddings verwendet wird |
Claude Desktop Konfiguration
{
"mcpServers": {
"little-librarian": {
"command": "python",
"args": ["/path/to/server.py"]
}
}
}Hardware-Empfehlungen
Setup | Min. VRAM |
Nur CPU | 0 GB |
GPU (pplx-embed-0.6b) | ~2 GB |
This server cannot be deployed
Maintenance
Related MCP Connectors
Agent-native MCP server over the public saagarpatel.dev corpus. Read-only, stateless.
Remote ChromaDB vector database MCP server with streamable HTTP transport
Personal knowledge base MCP server with semantic search, auto-categorization, metadata extraction
Related MCP Servers
- FlicenseNot gradedqualityDmaintenanceLocal MCP server that provides semantic search (RAG) over code repositories, enabling AI clients like Claude and Gemini to access project context without manual re-upload.-
- AlicenseAqualityDmaintenanceLocal-first RAG indexing and semantic search MCP server. Enables document retrieval and context-aware queries using local embedding models.313 npmMIT
- AlicenseNot gradedqualityAmaintenanceMCP server for local RAG over personal notes, PDFs, and documents, enabling plain-English querying and hybrid search with multi-hop context expansion.MIT
- FlicenseNot gradedqualityBmaintenanceMCP server for querying a personal knowledge base using semantic RAG, powered by DeepSeek and local embeddings from Ollama.-