Skip to main content
Glama

little-librarian

Un servidor MCP local que indexa archivos .epub y expone herramientas de búsqueda semántica respaldadas por pplx-embed-context-v1 (late chunking) y Qdrant.

MCP client (Claude Desktop, Claude Code, …)
     │
     ▼  tool calls via MCP
 server.py
  pplx-embed-context-v1-0.6b  +  Qdrant (local)

Archivos

Archivo

Rol

server.py

Servidor MCP: ingesta de epub, embedding, búsqueda, almacenamiento en Qdrant

code_librarian.py

Servidor MCP independiente para código (fragmentación basada en AST)


Related MCP server: ragi

Por qué pplx-embed-context-v1

Utiliza late chunking: todos los fragmentos de un capítulo pasan por una única pasada hacia adelante, por lo que cada embedding de fragmento captura el contexto completo del documento sin necesidad de un prefijo de documento en el momento de la inferencia. Obtiene una puntuación de 81.96 nDCG@10 en ConTEB.


Inicio rápido

# 1. install
pip install -e .

# 2. ingest your library (runs embedding, then exits)
HF_HUB_OFFLINE=0 python server.py --index ./library

# 3. start the MCP server
python server.py

# optional: preload the model at startup
python server.py --preload

Herramientas MCP

Herramienta

Descripción

search(query, top_k)

Búsqueda semántica, devuelve los k mejores pasajes con puntuaciones

search_groups(query, group_by, limit, group_size)

Búsqueda agrupada por "book" o "chapter": ideal para investigación entre volúmenes

get_passage(book, chapter, max_chars)

Recupera el texto completo de un libro/capítulo

list_books()

Lista todos los libros indexados con el recuento de capítulos

collection_stats()

Información de la colección de Qdrant (recuento de puntos, tamaño del vector)

library_stats()

Desglose completo del contenido: libros, capítulos, fragmentos por libro, longitud media de fragmento

get_device()

Muestra qué dispositivo (CPU/GPU) se utiliza para los embeddings


Configuración de Claude Desktop

{
  "mcpServers": {
    "little-librarian": {
      "command": "python",
      "args": ["/path/to/server.py"]
    }
  }
}

Guía de hardware

Configuración

VRAM mín.

Solo CPU

0 GB

GPU (pplx-embed-0.6b)

~2 GB

F
license - not found
-
quality - not tested
D
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • F
    license
    -
    quality
    D
    maintenance
    Local MCP server that provides semantic search (RAG) over code repositories, enabling AI clients like Claude and Gemini to access project context without manual re-upload.
  • A
    license
    A
    quality
    D
    maintenance
    Local-first RAG indexing and semantic search MCP server. Enables document retrieval and context-aware queries using local embedding models.
    3
    9
    MIT
  • A
    license
    -
    quality
    B
    maintenance
    MCP server for local RAG over personal notes, PDFs, and documents, enabling plain-English querying and hybrid search with multi-hop context expansion.
    MIT

View all related MCP servers

Related MCP Connectors

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/unlomtrois/little-librarian'

If you have feedback or need assistance with the MCP directory API, please join our Discord server