Semantic Search MCP
Semantische Suche
Semantische Suche über Markdown-Dateien. Finden Sie verwandte Notizen nach Bedeutung, nicht nur nach Schlüsselwörtern. Erkennen Sie Duplikate, bevor Sie neue Notizen erstellen.
Unterstützt zwei Server-Transportwege:
stdio MCP — Für die Claude Code-Integration (ein Prozess pro Sitzung)
HTTP — Kombiniertes MCP-über-HTTP + REST auf einem Port; ein warmer Prozess, der von allen Clients geteilt wird
Funktionen
Semantische Suche mittels sentence-transformers
Erkennung von doppelten/ähnlichen Notizen
Automatische Index-Aktualisierung mit Datei-Überwachung
Unterstützung für mehrere Verzeichnisse
Inline-Tag-Extraktion (
#tag-name)
Related MCP server: mcp-recall-md
Installation
CPU-only Installation — empfohlen für macOS (jeder Mac, Apple Silicon oder Intel) und Linux/Windows ohne NVIDIA GPU. Spart ca. 5 GB an CUDA-Binärdateien. Unter macOS wird die Apple GPU (MPS) weiterhin automatisch erkannt und über das in PyTorch integrierte MPS-Backend genutzt — das Label "CPU" bezieht sich nur auf das Fehlen von CUDA, nicht auf das Rechengerät zur Laufzeit.
uv tool install --index https://download.pytorch.org/whl/cpu \
git+https://github.com/bborbe/semantic-searchCUDA-Installation — nur für Linux/Windows mit einer dedizierten NVIDIA GPU. Nicht anwendbar auf macOS (NVIDIA CUDA wird auf dem Mac nicht unterstützt).
uv tool install git+https://github.com/bborbe/semantic-searchUpgrade
uv tool upgrade semantic-searchServer-Modi
stdio MCP (pro Sitzung Claude Code)
Startet einen Prozess pro Claude Code-Sitzung. Einfach, aber jede Sitzung lädt ihre eigene ~400 MB–1 GB Modellkopie.
claude mcp add -s project semantic-search \
--env CONTENT_PATH=/path/to/vault \
-- \
uvx --from git+https://github.com/bborbe/semantic-search semantic-search-mcpVerfügbare Tools:
search_related(query, top_k=5)— Findet semantisch verwandte Notizencheck_duplicates(file_path)— Erkennt doppelte/ähnliche Notizen
HTTP (geteilt über alle Clients)
Ein einzelner, lang laufender Prozess stellt MCP-über-HTTP unter /mcp sowie REST unter /search, /duplicates, /health, /reindex bereit. Alle Claude Code-Sitzungen und REST-Clients teilen sich einen warmen Indexer.
CONTENT_PATH=/path/to/vault semantic-search-http --host 127.0.0.1 --port 8321Verweisen Sie Claude Code über die MCP-Konfiguration darauf:
{
"mcpServers": {
"semantic-search": {
"type": "http",
"url": "http://127.0.0.1:8321/mcp"
}
}
}REST-Endpunkte:
Endpunkt | Methode | Beschreibung |
| POST | MCP-über-HTTP (Claude Code) |
| GET | Semantische Suche |
| GET | Findet doppelte Notizen |
| GET | Gesundheitsprüfung mit Index-Statistiken |
| GET/POST | Erzwingt den Neuaufbau des Index |
Beispielabfragen:
# Search
curl 'http://127.0.0.1:8321/search?q=kubernetes+deployment'
# Find duplicates
curl 'http://127.0.0.1:8321/duplicates?file=notes/my-note.md'
# Health check
curl 'http://127.0.0.1:8321/health'Claude Code Plugin
Dieses Repo wird auch als Claude Code Marketplace-Plugin mit Befehlen für Einrichtung, Suche und Recherche ausgeliefert.
Installation
claude plugin marketplace add bborbe/semantic-search
claude plugin install semantic-searchUpdate
claude plugin marketplace update semantic-search
claude plugin update semantic-search@semantic-searchSchnellstart
# One-shot interactive setup: installs the binary, writes the launchd/systemd
# unit, registers the MCP server in your Claude config.
/semantic-search:configure
# Search indexed markdown
/semantic-search:search kubernetes deployment
# Multi-step research across results
/semantic-search:research kafka backup strategyBefehle
Befehl | Beschreibung |
| Installiert |
| Semantische Suche über den laufenden MCP-Server |
| Mehrstufige Recherche — suchen, kategorisieren, Top-Quellen lesen, synthetisieren |
Im Hintergrund ausführen
Für den produktiven Einsatz führen Sie semantic-search-http als Hintergrunddienst aus, damit jede Claude Code-Sitzung (und jeder REST-Client) einen warmen Prozess teilt.
Plattform | Anleitung |
macOS (launchd) | |
Linux (systemd) |
Kurzes Beispiel (macOS):
launchctl load ~/Library/LaunchAgents/com.github.bborbe.semantic-search-http.plistKurzes Beispiel (Linux):
systemctl --user enable --now semantic-search-http.serviceCLI-Befehle
Einmalige Befehle ohne laufenden Server:
# Search
CONTENT_PATH=/path/to/vault semantic-search search "kubernetes deployment"
# Find duplicates
CONTENT_PATH=/path/to/vault semantic-search duplicates path/to/note.mdBinärdateien
Binärdatei | Zweck |
| Kombinierter HTTP-Server — MCP unter |
| stdio MCP-Server — einer pro Claude Code-Sitzung. Verwenden, wenn kein HTTP-Dienst eingerichtet ist. |
| Nur CLI — |
Konfiguration
Umgebungsvariablen
Variable | Beschreibung | Standard |
| Zu indexierendes Verzeichnis (durch Kommas getrennt für mehrere) |
|
| Logging-Level (DEBUG, INFO, WARNING, ERROR) |
|
Mehrere Verzeichnisse
Indexieren Sie mehrere Verzeichnisse, indem Sie die Pfade mit Kommas trennen:
CONTENT_PATH=/path/to/vault1,/path/to/vault2,/path/to/docsAlle Verzeichnisse werden zusammen indexiert und als ein einheitlicher Index durchsucht.
Funktionsweise
Der erste Durchlauf lädt ein kleines Embedding-Modell (~90 MB) herunter und indexiert Ihre Markdown-Dateien (<1s für typische Vaults). Der Index aktualisiert sich automatisch, wenn Dateien über den Dateisystem-Watcher geändert werden.
Indexierte Inhalte
Jede Markdown-Datei wird mit gewichteten Komponenten indexiert:
Komponente | Gewichtung | Notizen |
Dateiname | 3x | |
Frontmatter | 3x | |
Frontmatter | 2x | Zusammengeführt mit Inline-Tags |
Frontmatter | 2x | |
Inline-Tags ( | 2x | Aus dem Text extrahiert |
Erste H1-Überschrift | 2x | |
Textinhalt | 1x | Erste 500 Wörter |
Entwicklung
# Clone
git clone https://github.com/bborbe/semantic-search
cd semantic-search
# Install dev dependencies
make install
# Run checks
make check
# Run tests
make testLizenz
BSD 2-Clause License — siehe LICENSE.
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- AlicenseNot gradedqualityBmaintenanceEnables semantic search and knowledge graph exploration of Obsidian vaults using Smart Connections embeddings. Provides intelligent note discovery, similarity search, and connection mapping through natural language queries.11354MIT
- AlicenseAqualityCmaintenanceEnables semantic search over local markdown note collections using vector embeddings, with real-time file watching and zero-config setup.4MIT
- FlicenseNot gradedqualityDmaintenanceEnables managing and searching markdown notes with semantic search, question answering, and note generation, and provides an MCP server for GitHub Copilot integration.4
- AlicenseNot gradedqualityCmaintenanceEnables semantic search over an Obsidian vault using natural language, retrieving relevant notes and extracted conclusions.MIT
Related MCP Connectors
Search and reason over your Obsidian-style Markdown vault, right from ChatGPT.
Search your Obsidian vault to quickly find notes by title or keyword, summarize related content, a…
Token-efficient MCP memory for Markdown vaults. Tiered search, GraphRAG, AI memories.
Appeared in Searches
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/bborbe/semantic-search'
If you have feedback or need assistance with the MCP directory API, please join our Discord server