RAG MCP Server
MCP RAG com Python, LangChain, LangGraph e LlamaIndex
Projeto de servidor Model Context Protocol (MCP) para indexar documentos e responder perguntas com RAG (Retrieval-Augmented Generation). O servidor usa FastMCP via SSE, LlamaIndex + ChromaDB para recuperação, LangGraph para orquestração e LangChain para geração.
Arquitetura
Cliente MCP -> SSE (/sse) -> FastMCP
-> ingest_documents(paths)
-> ask_rag(question)
-> LangGraph
-> recuperar contexto (LlamaIndex/Chroma)
-> gerar resposta (LangChain/OpenAI)
-> validar citaçõesRelated MCP server: Antigravity PDF MCP Server
Início rápido
cp .env.example .env
# Edite .env e informe OPENAI_API_KEY
docker compose up --buildO endpoint MCP SSE fica em http://localhost:8000/sse.
Documentos
Para tornar uma pasta local disponível ao contêiner, descomente o volume ./docs:/workspace/docs:ro no docker-compose.yml. Em seguida, chame a ferramenta com um caminho como /workspace/docs/manual.md.
Ferramentas MCP
ingest_documents
Indexa arquivos .txt, .md e .pdf.
{"paths": ["/workspace/docs/manual.md"]}ask_rag
Recupera os trechos mais relevantes e responde com referências [S1], [S2].
{"question": "Quais são os procedimentos de backup?", "top_k": 5}Variáveis de ambiente
Variável | Uso |
| Chave da API compatível com OpenAI |
| Modelo de geração LangChain |
| Modelo de embeddings LlamaIndex |
| URL-base opcional de endpoint compatível |
| Diretório persistente do ChromaDB |
| Nome da coleção vetorial |
| Tamanho dos trechos indexados |
| Sobreposição entre trechos |
Segurança
Não exponha o SSE publicamente sem TLS e autenticação. Monte somente diretórios de documentos autorizados, pois a ferramenta de ingestão lê os caminhos informados.
This server cannot be deployed
Maintenance
Related MCP Connectors
Ingest, manage, and retrieve documents for RAG-powered AI applications
Turn documents into structured, AI-ready data by parsing, enriching, chunking, and embedding.
Versioned documentation registry and semantic search for AI tools and coding assistants.
Related MCP Servers
- FlicenseNot gradedqualityDmaintenanceEnables RAG (Retrieval-Augmented Generation) capabilities with document processing, vector storage, and intelligent Q\&A using OpenAI embeddings and semantic search.-
- FlicenseNot gradedqualityDmaintenanceEnables intelligent ingestion and querying of PDF, Markdown, and text files using hybrid search that combines keyword matching and semantic embeddings with citations.2-
- AlicenseAqualityDmaintenanceEnables document Q&A with grounded citations using the official Gemini File Search API. Upload documents, create stores, and ask questions that return exact passage citations.78 npm2MIT
- FlicenseNot gradedqualityDmaintenanceEnables searching a knowledge base and asking grounded questions with hybrid retrieval, reranking, and cited answers.-