Skip to main content
Glama
██╗      ██████╗  ██████╗  ██████╗ ███████╗
██║     ██╔═══██╗██╔════╝ ██╔═══██╗██╔════╝
██║     ██║   ██║██║  ███╗██║   ██║███████╗
██║     ██║   ██║██║   ██║██║   ██║╚════██║
███████╗╚██████╔╝╚██████╔╝╚██████╔╝███████║
╚══════╝ ╚═════╝  ╚═════╝  ╚═════╝ ╚══════╝

        ███████╗██╗     ██╗   ██╗██╗  ██╗
        ██╔════╝██║     ██║   ██║╚██╗██╔╝
        █████╗  ██║     ██║   ██║ ╚███╔╝ 
        ██╔══╝  ██║     ██║   ██║ ██╔██╗ 
        ██║     ███████╗╚██████╔╝██╔╝ ██╗
        ╚═╝     ╚══════╝ ╚═════╝ ╚═╝  ╚═╝

Mnemo

Memoria extendida para asistentes de IA mediante caché de contexto de Gemini.

Mnemo (del griego: memoria) permite a asistentes de IA como Claude acceder a grandes bases de código, sitios de documentación, archivos PDF y más, aprovechando la ventana de contexto de 1M de tokens de Gemini y sus funciones de caché de contexto.

¿Por qué Mnemo?

En lugar de complejos procesos de RAG con embeddings y recuperación, Mnemo adopta un enfoque más sencillo:

  • Carga toda tu base de código en la caché de contexto de Gemini

  • Consúltala con lenguaje natural

  • Deja que Claude coordine mientras Gemini mantiene el contexto

Esto te ofrece:

  • Recuperación perfecta: sin fragmentación ni recuperación, lo que significa que no se pierde contexto

  • Menor latencia: el contexto en caché se sirve rápidamente

  • Ahorro de costes: los tokens en caché cuestan entre un 75% y un 90% menos que los tokens de entrada normales

  • Simplicidad: sin bases de datos vectoriales, embeddings ni lógica de recuperación compleja

Related MCP server: Heimdall MCP Server

¿Qué puede cargar Mnemo?

Fuente

Servidor local

Worker

Repositorios de GitHub (públicos)

Repositorios de GitHub (privados)

Cualquier URL (docs, artículos)

Documentos PDF

APIs JSON

Archivos/directorios locales

Rastreo de múltiples páginas

✅ ilimitado

✅ 40 páginas máx.

Opciones de despliegue

Mnemo se puede desplegar de tres formas según tus necesidades.

Opción 1: Servidor local (Desarrollo y funciones completas)

Ideal para desarrollo y cuando necesitas cargar archivos locales.

# Clone and install
git clone https://github.com/logos-flux/mnemo
cd mnemo
bun install

# Set your Gemini API key
export GEMINI_API_KEY=your_key_here

# Start the server
bun run dev

Configuración de Claude Code MCP:

{
  "mcpServers": {
    "mnemo": {
      "type": "http",
      "url": "http://localhost:8080/mcp"
    }
  }
}

Opción 2: Cloudflare Worker autohospedado (Recomendado para Claude.ai)

Despliégalo en tu propia cuenta de Cloudflare. Tú controlas tus datos y costes.

Requisitos previos:

# Clone and install
git clone https://github.com/logos-flux/mnemo
cd mnemo/packages/cf-worker

# Configure secrets
bunx wrangler secret put GEMINI_API_KEY
bunx wrangler secret put MNEMO_AUTH_TOKEN  # Optional but recommended

# Create D1 database
bunx wrangler d1 create mnemo-cache

# Deploy
bunx wrangler deploy

Configuración de Claude.ai MCP:

{
  "mcpServers": {
    "mnemo": {
      "type": "http",
      "url": "https://mnemo.<your-subdomain>.workers.dev/mcp",
      "headers": {
        "Authorization": "Bearer YOUR_AUTH_TOKEN"
      }
    }
  }
}

¿Por qué usar esto? Claude.ai no puede conectarse a localhost. El Worker te proporciona un endpoint externo al que Claude.ai puede acceder.


Opción 3: Alojamiento gestionado (VIP)

¿No quieres gestionar la infraestructura? Ofrecemos alojamiento de Mnemo totalmente gestionado para clientes seleccionados.

Incluye:

  • Despliegue de Worker dedicado

  • Soporte prioritario

  • Dominio personalizado

  • Monitorización de uso

Contacto: lf@logosflux.io para precios y disponibilidad.


Ejemplos de uso

# Load a GitHub repo
curl -X POST http://localhost:8080/tools/context_load \
  -H "Content-Type: application/json" \
  -d '{"source": "https://github.com/honojs/hono", "alias": "hono"}'

# Load a documentation site (crawls up to token target)
curl -X POST http://localhost:8080/tools/context_load \
  -H "Content-Type: application/json" \
  -d '{"source": "https://hono.dev/docs", "alias": "hono-docs"}'

# Load a PDF
curl -X POST http://localhost:8080/tools/context_load \
  -H "Content-Type: application/json" \
  -d '{"source": "https://arxiv.org/pdf/2303.08774.pdf", "alias": "gpt4-paper"}'

# Load a private repo (with GitHub token)
curl -X POST http://localhost:8080/tools/context_load \
  -H "Content-Type: application/json" \
  -d '{"source": "https://github.com/owner/private-repo", "alias": "private", "githubToken": "ghp_xxx"}'

# Load multiple sources into one cache
curl -X POST http://localhost:8080/tools/context_load \
  -H "Content-Type: application/json" \
  -d '{"sources": ["https://github.com/owner/repo", "https://docs.example.com"], "alias": "combined"}'

# Query the cache
curl -X POST http://localhost:8080/tools/context_query \
  -H "Content-Type: application/json" \
  -d '{"alias": "hono", "query": "How do I add middleware?"}'

# List active caches
curl -X POST http://localhost:8080/tools/context_list \
  -H "Content-Type: application/json" -d '{}'

# Get usage stats with cost tracking
curl -X POST http://localhost:8080/tools/context_stats \
  -H "Content-Type: application/json" -d '{}'

# Evict when done
curl -X POST http://localhost:8080/tools/context_evict \
  -H "Content-Type: application/json" \
  -d '{"alias": "hono"}'

CLI

# Start server
mnemo serve

# Start MCP stdio transport (for Claude Desktop)
mnemo stdio

# Load a project
mnemo load ./my-project my-proj

# Query
mnemo query my-proj "What's the main entry point?"

# List caches
mnemo list

# Remove cache
mnemo evict my-proj

Herramientas MCP

Herramienta

Descripción

context_load

Carga repositorios de GitHub, URLs, PDFs o directorios locales en la caché de Gemini

context_query

Consulta un contexto en caché con lenguaje natural

context_list

Lista todas las cachés activas con recuento de tokens y caducidad

context_evict

Elimina una caché

context_stats

Obtiene estadísticas de uso con seguimiento de costes

context_refresh

Recarga una caché con contenido actualizado

Parámetros de context_load

Parámetro

Descripción

source

Fuente única: URL de GitHub, cualquier URL o ruta local

sources

Múltiples fuentes para combinar en una sola caché

alias

Nombre descriptivo para esta caché (1-64 caracteres)

ttl

Tiempo de vida en segundos (60-86400, por defecto 3600)

githubToken

Token de GitHub para repositorios privados

systemInstruction

Prompt del sistema personalizado para consultas

Configuración

Variable

Descripción

Por defecto

GEMINI_API_KEY

Tu clave de API de Gemini

Requerido

MNEMO_PORT

Puerto del servidor (solo local)

8080

MNEMO_DIR

Directorio de datos (solo local)

~/.mnemo

MNEMO_AUTH_TOKEN

Token de autenticación para endpoints protegidos

Ninguno

Autenticación

Cuando se configura MNEMO_AUTH_TOKEN, los endpoints /mcp y /tools/* requieren autenticación:

# Set auth token (Workers)
bunx wrangler secret put MNEMO_AUTH_TOKEN

# Requests must include header:
Authorization: Bearer your-token-here

Endpoints públicos (no requieren autenticación):

  • GET /health - Comprobación de estado

  • GET / - Información del servicio

  • GET /tools - Lista de herramientas disponibles

Costes

Siempre pagas por el uso de la API de Gemini independientemente de la opción de despliegue. Mnemo utiliza la caché de contexto de Gemini, que es significativamente más barata que la entrada estándar:

Recurso

Coste

Almacenamiento en caché

~$4.50 por 1M de tokens por hora

Entrada en caché

75-90% de descuento frente a entrada normal

Entrada normal

~$0.075 por 1M de tokens (Flash)

Ejemplo: Base de código de 100K tokens en caché durante 1 hora con 10 consultas ≈ $0.47

Costes de Cloudflare (autohospedado):

  • Workers: La versión gratuita incluye 100K solicitudes/día

  • D1: La versión gratuita incluye 5M de lecturas/día

  • Probablemente $0 para un uso moderado

Arquitectura

┌─────────────────────────────────────────────────────────────┐
│                         Mnemo                                │
├─────────────────────────────────────────────────────────────┤
│  MCP Tools                                                   │
│  • context_load    - Load into Gemini cache                 │
│  • context_query   - Query cached context                   │
│  • context_list    - Show active caches                     │
│  • context_evict   - Remove cache                           │
│  • context_stats   - Token usage, costs                     │
│  • context_refresh - Reload cache                           │
├─────────────────────────────────────────────────────────────┤
│  Adapters (v0.2)                                             │
│  • GitHub repos (via API)                                   │
│  • URL loading (HTML, PDF, JSON, text)                      │
│  • Token-targeted crawling                                  │
│  • robots.txt compliance                                    │
├─────────────────────────────────────────────────────────────┤
│  Packages                                                    │
│  • @mnemo/core      - Gemini client, loaders, adapters      │
│  • @mnemo/mcp-server - MCP protocol handling                │
│  • @mnemo/cf-worker - Cloudflare Workers deployment         │
│  • @mnemo/local     - Bun-based local server                │
└─────────────────────────────────────────────────────────────┘

Licencia

MIT

Créditos

Creado por Logos Flux | Voltage Labs

Tool Schema Changelog

Recent tool additions, removals, and schema changes observed during successful MCP inspections. Dates show when Glama detected each change.

No tool schema history has been recorded yet.

Maintenance

ActivityInactive
ResponsivenessNo issues

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Connectors

Related MCP Servers

  • A
    license
    B
    quality
    C
    maintenance
    Provides AI assistants with persistent memory of your project architecture, development history, and technical decisions, allowing them to give context-aware coding help without needing repeated explanations.
    16
    61
    2
    MIT
  • A
    license
    Not graded
    quality
    D
    maintenance
    Provides AI coding assistants with persistent, context-rich memory of a codebase, including documentation and git history, enabling recall across sessions.
    104
    Apache 2.0
  • A
    license
    A
    quality
    B
    maintenance
    Provides persistent memory and a codebase knowledge graph for AI coding assistants, enabling shared context across multiple tools like Claude, Cursor, and ChatGPT, with significant token reduction.
    5
    25
    MIT

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/Logos-Flux/mnemo'

If you have feedback or need assistance with the MCP directory API, please join our Discord server