Skip to main content
Glama

Groundlane

English | 繁體中文

La capa de acceso web de confianza para agentes de IA.

Groundlane es un servidor MCP remoto de código abierto y neutral respecto al proveedor, diseñado para dar a los agentes de IA un acceso controlado a la web pública. Presenta una interfaz estable para búsqueda, recuperación y extracción determinista, enruta la búsqueda hacia proveedores sustituibles y escala las lecturas complejas de Markdown mediante un Jina Reader opcional antes de recurrir a un navegador local aislado o a Browserless.

[!IMPORTANT] Groundlane es una vista previa temprana. Sus contratos de herramientas y su modelo de despliegue aún están en evolución; no trates la versión actual como un servicio alojado ni como una solución universal contra el bloqueo automatizado.

Por qué Groundlane

  • Neutral respecto al modelo: conéctate a cualquier cliente MCP HTTP Streamable en lugar de depender de la herramienta web integrada de un proveedor de modelos.

  • Neutral respecto al proveedor: enruta entre APIs de búsqueda con cuotas mensuales gratuitas recurrentes bajo un único contrato de resultados normalizado.

  • HTTP primero, navegador cuando sea necesario: mantén rápidas las lecturas habituales y reserva Chromium para JavaScript, condiciones de espera y señales de respaldo compatibles.

  • Extracción determinista: selecciona campos con selectores CSS y recibe JSON estructurado sin un paso implícito de LLM.

  • Seguridad primero: autentica el endpoint MCP y aplica límites de URL, redirecciones, red, tiempo de espera, salida y concurrencia.

  • Despliegue autogestionado: ejecuta el plano de control y la carga de trabajo del navegador en tu propio entorno, incluidos Cloudflare Workers y Containers.

Related MCP server: agentfetch

Herramientas MVP

Herramienta

Propósito

Alcance actual

web_fetch

Recupera una URL como Markdown, texto o HTML

HTTP acotado, Jina Reader opcional y, en último caso, navegador

web_search

Busca a través de un proveedor configurado

Enrutamiento explícito o automático entre siete proveedores

web_extract

Extrae campos con nombre de una página

Selectores CSS; valores de texto, HTML o atributos

La automatización del navegador es un detalle de implementación interno llamado Groundlane Browser. Groundlane no expone sesiones de navegador persistentes en el MVP.

Inicio rápido

Requisitos previos

  • Node.js 22 o superior

  • pnpm 10

  • Chromium para el respaldo con navegador

  • Al menos una clave de proveedor de búsqueda gratuita mensual si quieres usar web_search (Tavily, Exa, Parallel, Browserbase, Brave, Firecrawl o SerpApi)

Ejecución local

Clona este repositorio y ejecuta:

pnpm install
pnpm exec playwright install chromium
cp .env.example .env
set -a
source .env
set +a
pnpm dev

Establece un GROUNDLANE_AUTH_TOKEN seguro en .env. Añade una o más claves de proveedor compatibles para habilitar la búsqueda. El servidor local escucha en el PORT configurado y sirve:

  • POST /mcp — endpoint MCP HTTP Streamable autenticado

  • GET /healthz — estado del proceso

  • GET /readyz — disponibilidad del contenedor y estado de la configuración del servicio

Conexión de un cliente MCP

Configura un cliente MCP HTTP Streamable con la URL del servidor y el token de portador. Las formas de configuración del cliente varían, pero los valores de conexión son:

URL: http://localhost:8080/mcp
Authorization: Bearer <GROUNDLANE_AUTH_TOKEN>

Nunca pongas el token en una cadena de consulta ni lo confirmes en el control de versiones.

Con el servidor en marcha, abre otra terminal, carga el mismo .env y verifica el protocolo de enlace MCP y la ruta HTTP pública:

set -a
source .env
set +a
pnpm smoke

Establece GROUNDLANE_SMOKE_BROWSER=1 para incluir la ruta del navegador.

Configuración

Groundlane lee la configuración de variables de entorno. Consulta .env.example para ver una plantilla local completa.

Variable

Propósito

Valor predeterminado / ejemplo

GROUNDLANE_AUTH_TOKEN

Token de portador requerido por /mcp

Obligatorio

SEARCH_PROVIDER_ORDER

Candidatos de enrutamiento automático ordenados

tavily,exa,parallel,browserbase,brave,firecrawl,serpapi

SEARCH_MONTHLY_REQUEST_BUDGETS

Límites de intentos por proveedor, reiniciados cada mes UTC

Valores conservadores del plan gratuito

TAVILY_API_KEY

Credencial del adaptador Tavily

Opcional

EXA_API_KEY

Credencial del adaptador Exa

Opcional

FIRECRAWL_API_KEY

Credencial del adaptador Firecrawl Search

Opcional

SERPAPI_API_KEY

Credencial del adaptador SerpApi Google Search

Opcional

BROWSERBASE_API_KEY

Credencial del adaptador Browserbase Search

Opcional

PARALLEL_API_KEY

Credencial del adaptador Parallel Search

Opcional

BRAVE_API_KEY

Credencial del adaptador Brave Search

Opcional

READER_BACKEND

Respaldo del lector de Markdown: disabled o jina

disabled de forma predeterminada

BROWSER_BACKEND

Capacidad de navegador: disabled, local o browserless

disabled de forma predeterminada

BROWSERLESS_TOKEN

Credencial de /content de Browserless

Solo necesario para browserless

BROWSERLESS_REGION

Región del endpoint de Browserless: sfo, lon o ams

sfo

REQUEST_TIMEOUT_MS

Plazo de extremo a extremo de la solicitud

30000 de forma local

MAX_RESPONSE_BYTES

Máximo de bytes de respuesta del origen

2000000 de forma local

MAX_OUTPUT_CHARS

Máximo de caracteres de texto devueltos

100000 de forma local

MAX_CONCURRENCY

Máximo de solicitudes activas

4 de forma local

MAX_QUEUE

Máximo de solicitudes en cola

16 de forma local

La ausencia de credenciales de búsqueda no impide que web_fetch o web_extract funcionen. Solo deja indisponible al proveedor de búsqueda correspondiente.

Los presupuestos mensuales cuentan los intentos de solicitud a proveedores, incluidos los fallos reintentables, e impiden que una instancia de Groundlane seleccione un proveedor una vez superado su límite configurado. Son deliberadamente conservadores, pero no reflejan la facturación real: los contenedores se reinician, varias instancias no comparten contadores y algunos proveedores cobran créditos variables. Mantén habilitados los límites de gasto del proveedor y ajusta los presupuestos según tus planes reales.

Arquitectura

MCP client
    |
    v
Cloudflare Worker / Node HTTP edge
    |  authentication, limits, request identity
    v
tool registry
    |-- web_search  -> monthly-free provider router (7 adapters)
    |-- web_fetch   -> safe HTTP -> optional Jina Reader -> browser fallback
    `-- web_extract -> fetch pipeline -> deterministic DOM extraction

Las políticas y contratos principales no dependen de un proveedor ni del runtime del navegador. Los adaptadores se sitúan tras interfaces estrechas. El backend del navegador puede ser Playwright local en el contenedor o /content de Browserless; los campos de salida engine y backend revelan qué ruta produjo un resultado sin cambiar las herramientas MCP públicas. Los backends alojados reciben la URL pública solicitada, por lo que son opcionales y no silenciosos por defecto.

Lee Arquitectura para conocer los límites de los componentes, el flujo de solicitudes y las decisiones de diseño.

Seguridad

La recuperación web es una capacidad sensible a SSRF. Groundlane trata las URL de los usuarios, las redirecciones, los subrecursos del navegador y las URL de los proveedores de búsqueda como no confiables. Los despliegues deben mantener la autenticación habilitada, usar una política de red de salida y conservar los límites de recursos predeterminados.

El proyecto no promete resolución universal de CAPTCHA, automatización invisible ni acceso a contenido que no estés autorizado a recuperar. Los operadores son responsables de los términos de los sitios de destino, las políticas de robots, las obligaciones de privacidad y la legislación aplicable.

Consulta SECURITY.md para conocer el modelo de seguridad y el proceso privado de notificación de vulnerabilidades.

Despliegue

La topología de producción prevista usa un Cloudflare Worker como plano de control público y un Cloudflare Container para la carga de trabajo del navegador Node/Playwright. Para requisitos previos, secretos, pasos de despliegue y verificación, consulta Despliegue en Cloudflare.

Hoja de ruta

  • Definir la superficie neutral de web_fetch, web_search y web_extract determinista

  • Añadir backends de recuperación opcionales de Jina Reader y Browserless con procedencia

  • Estabilizar los contratos MCP y publicar accesorios de compatibilidad

  • Endurecer el despliegue de Cloudflare Worker + Container y la telemetría operativa

  • Añadir adaptadores de caché y enrutamiento consciente de salud/coste del proveedor

  • Añadir primitivas opcionales de lote/rastreo con presupuestos explícitos

  • Evaluar sesiones de navegador con estado como una capacidad separada y segura en cuanto a ciclo de vida

La hoja de ruta es orientativa, no un compromiso de publicación. Consulta el archivo de investigación para ver la evidencia que respalda el alcance actual.

Documentación

Contribución

Las incidencias y las solicitudes de extracción son bienvenidas. Antes de contribuir, lee CONTRIBUTING.md y el Código de conducta. Las vulnerabilidades de seguridad deben notificarse de forma privada como se describe en SECURITY.md.

Licencia

Groundlane está licenciado bajo la Apache License 2.0.

A
license - permissive license
Not graded
quality - not tested
B
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • A
    license
    A
    quality
    C
    maintenance
    An MCP server that enables AI assistants to fetch web content in multiple formats (HTML, JSON, text, Markdown) with intelligent content extraction, chunk management, and browser automation support.
    5
    52
    15
    MIT
  • A
    license
    Not graded
    quality
    B
    maintenance
    An open-source web retrieval MCP server that fetches, crawls, and searches the web, returning clean markdown for AI agents. It integrates with Claude MCP, LangChain, and other frameworks for agentic web access.
    1
    MIT
  • F
    license
    Not graded
    quality
    A
    maintenance
    An MCP server that provides browser-grade web access for AI agents, using Chrome's actual network stack to bypass anti-bot protections and return clean markdown.
    8

View all related MCP servers

Related MCP Connectors

  • An MCP server that gives your AI access to the source code and docs of all public github repos

  • Driflyte MCP server which lets AI assistants query topic-specific knowledge from web and GitHub.

  • Hosted MCP server connecting claude.ai, ChatGPT and other AI apps to your own computer

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/vincentxuu/groundlane'

If you have feedback or need assistance with the MCP directory API, please join our Discord server